核心认知能力」共找到 4663 篇相关文章

7

Meta两员大将回流OpenAI,30天爆赚800万?刚入职闪回巢,小扎钞能力失效

Meta成立两月的“梦之队”MSL痛失三位核心研究员,两位前OpenAI员工入职一月回流,另一位因小扎一句话离职,十年老将也将加入OpenAI。Meta高薪挖人,却因内部重组、研发问题等面临人才流失。

新智元
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让大模型学会反思总结。大模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为大模型推理难题提供了解决方案。

AIGC开放社区
新闻资讯7

RLHF已死,RLVR引爆AGI革命!Claude 4核心成员万字对谈

Claude 4核心成员对谈指出,强化学习在语言模型上奏效,可验证奖励的强化学习(RLVR)比RLHF更优,模型有望从「专才」向「通才」过渡,未来AI智能体将完成白领工作,人们应做好准备。

新智元
算法论文8

端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程

南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能体能力

量子位
产品应用8

国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测

文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。

AI产品黄叔
新闻资讯8

医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球

文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。

量子位
新闻资讯8

Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro

Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。

AGI Hunt
算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心
算法论文8

LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式

多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心
算法论文8

图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力

上海交通大学联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。

AI科技评论