「未探索状态假说」共找到 874 篇相关文章
GPT-5 Pro独立做数学研究!读论文后给出更精确边界,OpenAI总裁:这是生命迹象
OpenAI研究人员喂给GPT - 5 Pro一篇凸优化问题论文,它读完给出更精确边界及证明。虽成果被人类论文反超,但思路不同,显示其有独立探索能力,OpenAI总裁称这是“生命迹象”。
作为软件架构师使用 AI 的经验
Avraham Poupko 在 OOP 大会分享软件架构师用 AI 经验,认为软件架构师不会被 AI 取代,AI 适合探索权衡、提炼语言,但缺乏情境推理和情感智能,人类在这方面更有优势。
小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源
微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。
冲击自回归,扩散模型正在改写下一代通用模型范式
Google I/O 2025 开发者大会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散式 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人大推出 LLaDA,后发展出多模态模型,国内团队跻身前列。
DeepMind:Transformer存在拓扑缺陷,思维链治标不治本
谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本高。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。
Nature重磅发文:深度学习x符号学习,是AGI唯一路径!
大模型虽惊艳,但权威认为仅靠神经网络难达人类级智能。符号AI曾被边缘化,如今‘神经–符号融合’升温。神经网络与符号算法各有利弊,业界探索出不同融合路径,不过对其能否通往AGI仍存争议。
国产类脑大模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型
中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。
幻觉终结者,PoG给大模型“打补丁”
传统检索方式易给大语言模型带入噪声,知识图谱虽能提供可靠知识,但处理多跳和多实体问题有局限。Paths-over-Graph(PoG)方法通过多跳路径探索、路径剪枝等提高LLMs在复杂任务中的表现,减少幻觉。
Self-Evolving 会是 2026 关键词吗?
2025年,Agent应用发展使LLM‘静态’局限成AI瓶颈,业界重视自进化能力,聚焦‘持续适应系统’。但该领域缺统一标准,有思潮认为统一标准、集体探索将带来机遇。还介绍了研究进展、重点演变等。
刚刚,Meta挖走OpenAI清华校友宋飏,任超级智能实验室研究负责人
本周四消息,原OpenAI战略探索团队负责人宋飏加入Meta,任新成立的Meta超级智能实验室研究负责人。今年6月起Meta开启AI人才争夺,已挖来至少11位顶尖人员,宋飏加入为其AI部门添活力。