「思考能力」共找到 3640 篇相关文章
GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了
OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。
全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛
AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。
改变强化学习范式,Meta新作呼应Sutton「经验时代」预言
图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力。
性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令
现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。
Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%
Anthropic 联合创始人 Jack Clark 发长文称,到 2028 年底,AI 实现端到端自动化研发概率超 60%。他分析多维度测试数据,指出 AI 在代码、科研、自我训练和管理等方面能力提升,也探讨了成真后的影响,但遭黄仁勋和陶哲轩质疑。
陶哲轩ICM 2026:数学界迎来「百年新危机」,AI狂飙逼迫全行业重写游戏规则
7月24日,陶哲轩在ICM 2026演讲指出数学界正经历新危机,关乎价值观与工作方式。他围绕AI能力猜想探讨数学界如何应对,列举目标和风险,提出需升级目标,还介绍莱顿宣言建议。
真正能用好AI的企业是怎么做的?(附企业级AI落地实战手册)
数字化深入,非结构化文档成企业难题。合合信息发布白皮书,提出复杂文本智能五大核心能力标准,用11个行业标杆案例展示多模态文本智能技术应用,提供可复制落地范本。
李建忠对话菲尔兹奖得主Timothy Gowers:整个数学研究的范式将被AI改变
奇点智能研究院院长李建忠与菲尔兹奖得主Timothy Gowers对话,探讨AI与数学研究的十个话题,涉及数学重塑AI、AI推理能力、自动形式化、数学研究未来及AI对数学教育的影响等。
近期,不错的LLM Agent统一记忆框架综述~
随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。
谷歌机器人大脑又进化了。成功率飙3倍,还能看表干活、保护自己
Google DeepMind发布机器人大脑Gemini Robotics ER 1.6模型,提升机器人空间感知、多视角解析与仪表读取准度,具精准指认、读表能力,还提高操作安全性与合规度,开发者可通过Gemini API等使用。