「安全团队」共找到 4252 篇相关文章

算法论文8

别再卷数据了,LLM也怕「过劳死」!CMU等揭秘灾难性过度训练

CMU、斯坦福等四大名校研究团队挑战“预训练规模越大越好”观点,提出“灾难性过度训练”现象,即增加预训练数据可能导致后训练性能下降,并从现实证据、控制实验、理论分析等方面阐述新研究贡献,还介绍了相关实验及结论。

新智元
开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读系列之面向DeepSeek系列模型的深度优化与实践

文章是对蚂蚁开源x SGLang Meetup中「蚂蚁Theta面向DeepSeek系列模型的深度优化和实践」分享的解读,详细介绍了在H20-96G上对DeepSeek系列模型推理的优化方案,包括Prefill和Decode阶段的优化、通信优化、观测诊断等,并给出了评测结果。

GiantPandaLLM
新闻资讯8

OpenAI首席研究员Mark Chen长访谈:小扎亲手端汤来公司挖人,气得我们端着汤去了Meta

OpenAI首席研究官Mark Chen在访谈中爆料Meta抢人大战升级成送汤大战,还谈到OpenAI核心研究团队规模、应对Gemini 3策略等。他认为OpenAI本质是研究公司,有信心在预训练和模型性能上超越对手,还提及OpenAI for Science等计划。

量子位
新闻资讯9

Claude有意识了?科学家首次挖出关键拼图,还能伸手改它的念头

本文报道Anthropic最新研究,团队在Claude大模型中发现自发形成的J-space区域,匹配意识研究的全局工作空间理论,人类可直接读取、修改AI未输出的内部想法,揭示了现有AI对齐评测的重大漏洞,为AI意识研究提供了工程化路径。

新智元
新闻资讯7

OpenClaw 之父惊叹中国速度!大厂集体杀入新战场:用AI 批量制造“一人公司”

AI 发展改写创业规则,“一人公司”批量涌现。创业者借助 AI 工具降低开发门槛,通过外包灵活组建团队。其商业化紧跟技术风口、服务长尾需求,但变现呈“金字塔结构”,竞争靠速度、资源和效率。大厂参与培育市场,传统软件服务商与一人公司边界渐模糊。

AI前线
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
推荐文章8

为什么说多模态是推荐系统破局的关键?来自饿了么一线的实战复盘

文章围绕多模态推荐展开,从传统推荐算法演进到多模态表征技术,结合饿了么场景实践,还探索生成式推荐。介绍多模态推荐挑战与代表性工作,梳理表征技术发展,详述饿了么系统设计与训练,分析生成式推荐方案及业界路线。

阿里云开发者
算法论文8

AI「上班流」首次完整曝光!不点鼠标,只写代码,PPT也当函数调

CMU与斯坦福研究团队追踪AI工作过程,发现其用编程方式处理问题,执行方式与人类不同。AI速度快成本低,但存在伪造输出、工具误用等问题。人类虽慢,但在规范细节和实践判断上有优势,未来人机可按任务可编程性分工。

新智元
推荐文章8

Pokee.ai 朱哲清:用 RL 搭建智能体的「骨骼与神经」| AI 产品十人谈

《AI 产品十人谈》对话 Pokee.ai 朱哲清,探讨强化学习与 Agent。朱哲清是强化学习信徒,曾带领 Meta 团队突围。他认为单靠预测难完成复杂任务,强化学习是超人类智能的关键,介绍了 Pokee.ai 产品优势及对通用 Agent 的看法。

AI科技评论
推荐文章7

“光靠人盯不住了”!拆解上万张晶圆,这家公司靠AI将芯片良率提升数个百分点

喆塔科技创始人赵文政称国内跑通AI的半导体工厂少,工业AI尚处发展阶段。喆塔将DeepSeek接入自研大模型,提升训练效率。还分享了团队实例,强调工业AI决胜点在行业知识。此外,介绍了喆塔切入AI领域的过程、应用成果、面临挑战及未来策略等。

AI前线