AI预训练范式」共找到 11153 篇相关文章

开源动态8

开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4

上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。

量子位
新闻资讯8

Hinton最新警告:杀手机器人或将带来更多战争,最大担忧是AI接管人类

近日,「AI教父」Geoffrey Hinton在采访中预警,「杀手机器人」等致命自主武器让战争更易发动,降低了战争成本、改变了战争方式。他更担忧人类被AI接管,还指出AI公司在安全方面做得不够,同时也提到了AI在医疗等领域的应用。

新智元
算法论文8

别再卷数据了,LLM也怕「过劳死」!CMU等揭秘灾难性过度训练

CMU、斯坦福等四大名校研究团队挑战“预训练规模越大越好”观点,提出“灾难性过度训练”现象,即增加预训练数据可能导致后训练性能下降,并从现实证据、控制实验、理论分析等方面阐述新研究贡献,还介绍了相关实验及结论。

新智元
推荐文章7

为什么伟大的 AI 产品不能被计划?

Anthropic的CPO Mike Krieger分享构建AI产品经验与哲学。他认为未来多数内容将由AI生成,判断重点在来源与可信性;伟大AI产品多自下而上生长,如MCP协议;还谈到AI应用面临易用性等问题。

特工宇宙
算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化
新闻资讯7

“现在读AI博士已经太晚了”

谷歌生成式AI团队创始成员Jad Tarifi劝退AI博士,称等毕业AI或被解决。当下科技巨头天价抢人才,AI也成裁员推手,应届毕业生就业难。他建议发展社交技能和同理心应对。

量子位
新闻资讯7

国产算力解决方案,如何赋能“AI for Science”?

AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。

芯师爷
新闻资讯7

一个Bug改通宵!用AI写超50%代码,只有32%资深开发者敢这么干

Fastly对美国开发者做AI生产力调研,发现高级开发者用AI交付代码量是初学者2.5倍,也揭示AI编码隐形成本。高级开发者更信任AI,而初级开发者因经验不足更谨慎,同时调研还涉及绿色编码认知。

新智元
推荐文章7

从上下文工程到 AI Memory,本质上都是在「拟合」人类的认知方式

文章结合胡塞尔现象学,探讨从上下文工程到AI Memory,指出它们本质在‘拟合’人类认知。介绍二者概念及构建方法,对比人类与AI记忆异同,还通过与胡塞尔对话,思考AI意识等哲学问题。

Founder Park
新闻资讯7

DeepSeek新模型意外曝光:AI Agent才是未来~

据彭博社消息,中国AI新星DeepSeek计划年底发布对标OpenAIAI Agent,能自主执行多步任务、自我学习进化。国内Kimi、Qwen也有相关动作,还分享了72多种高效AI工具。

PaperAgent