「后训练范式」共找到 4472 篇相关文章
token危机解决?扩散模型数据潜力3倍于自回归,重训480次性能仍攀升
新加坡国立大学AI研究者Jinjie Ni团队预训练扩散语言模型(DLMs)与自回归(AR)模型,发现DLMs是超强数据学习者,数据潜力超AR 3倍,重训480次性能仍攀升,还剖析同期研究方法论缺陷。
谷歌 Gemini 的新功能 Storybook 很有意思.....
推荐大家体验谷歌Gemini的新功能Storybook,它能生成任何主题的有声故事绘本。如以动漫风格介绍马斯克生平、梳理ChatGPT诞生后的AI发展等,虽有转换性别等情况,但免费且想象空间大。
实测GPT-5 Pro:别被普通版骗了!Pro才是OpenAI真正的顶级模型
新智元实测发现GPT-5表现飘忽,但其Pro版本实力强劲。在编程、推理计算、图像识别等多方面表现出色,网友实测后也赞不绝口。此外,文中还介绍了GPT-5提示指南及OpenAI放出旧模型的彩蛋。
字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限
强化学习虽提升大语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为大模型强化学习提供新范式。
6小时复刻AI IMO金牌成果,蚂蚁多智能体新进展已开源
2025年IMO赛场,顶尖大模型起初表现不佳后有突破。蚂蚁AWorld项目团队6小时复现并开源DeepMind解题结果,给出可一键运行系统。AWorld证明多智能体协同优势,还介绍复现思路、核心优势及体验方式。
从OpenAI离职创业到估值1700亿美元,Anthropic用4年时间引硅谷巨头疯狂押注
最新消息,Claude背后公司Anthropic即将达成新一轮融资50亿美元,总估值达1700亿,不到半年估值涨近3倍。该公司由前OpenAI员工创立,获亚马逊、谷歌等投资,其模型在代码生成领域优势明显。
200亿国产巨头,在这个赛道做到了全球第一
声学传感器龙头歌尔微电子冲刺港交所,它是全球第五大、中国第一大智能传感交互解决方案提供商,全球第一大声学传感器提供商,市场份额达43%。其发展历程长,技术投入大,虽面临挑战,但上市后未来可期。
阿里 Qwen3:持续开源,SOTA 连连!
很多从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在多方向发力且拿下多个开源榜单第一。
AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来
本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。
突发!美国解除封锁,英伟达可向中国销售H20 AI芯片
CNBC消息,美国政府向英伟达保证授予销售许可,将恢复对中国销售H20 AI芯片。此前该芯片受出口管制。黄仁勋加大游说,与特朗普会面后美态度转变,他还宣布新GPU,英伟达财报表现强劲。