AI模型训练」共找到 13660 篇相关文章

新闻资讯8

Sam Altman:即将推出远超预期的开源模型,ChatGPT记忆功能正在实现《Her》的愿景

Sam Altman在对话中透露OpenAI将发布‘远超预期’开源模型,分享创立初期挑战,明确GPT - 5等演进方向,展望AI伴侣、机器人发展,还向创业者喊话,强调AI用于科学前景。

AI寒武纪
算法论文8

750篇论文,彻底把统一多模态模型摸清了

未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。

PaperAgent
新闻资讯8

经纬领投2000万美元,Aether AI让机器人学会举一反三|甲子光年

6月18日,Aether AI获约2000万美元首轮融资。创始人黄碧薇认为主流大模型学的是相关性而非因果性,她将LLM和因果算法结合,打造因果世界模型,搭建“因果大脑”,并选择具身智能作为落地场景。

甲子光年
产品应用8

小红书提出社交大模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位
算法论文8

研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现

强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。

机器之心
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为大模型要规模化,断言大模型训练进入第三阶段。

量子位
新闻资讯8

VAST完成5000万美元A轮融资,加速构建世界模型与UGC互动内容平台

通用人工智能公司 VAST 完成 5000 万美元 A 轮融资,由阿里、恒旭资本联合领投。该公司在 3D 领域成果显著,发布全新 AI 3D 大模型家族,还将重点投入世界模型研发和 UGC 互动内容平台建设。

机器之心
产品应用7

搜索已死?被AI投毒搞怕了的我开始重新看待百度

作者辅导孩子背诗遇读音疑问,问AI结果更懵,百度则给出清晰准确答案且标注来源。原因在于AI基于大模型‘概率预测’易‘编答案’,百度用‘双层Agent’架构结合内容治理,答案更靠谱。

CourseAI
8

刚刚,中国AI闯入全球编程前二!前面只剩Claude

Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。

新智元
8

刚刚,OpenAI神秘新模型斩获IMO 2025金牌!攻克奥数巅峰,硅谷沸腾

OpenAI用全新通用推理模型夺下IMO 2025金牌,解出5道题狂揽35分,远超此前Gemini 2.5 Pro的13分。此或意味着其研发出颠覆性推理技术,告别CoT,且模型未针对IMO训练,有持久创造性思维。

新智元