「人类推理」共找到 3096 篇相关文章
Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡
Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能力提升等,还给出2026年组织需关注的4大领域。
LLM算力告急?把文本变图片,推理成本直接减半!
大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。
DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini
DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。
人类最后考试已不够用,Agent最后考试来了!
AI飞速进步,人类最后考试(HLE)已不够用,伯克利牵头推出智能体最后的考试(ALE)。ALE真实、全面、可验证,当前最强AI在最难档通过率仅8.6%,主流系统平均2.6%,显示AI距替人干活尚远。
Claude Opus 4.7 发布!留给人类的时间,不多了
Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑长且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。
刚刚,人类社交网络巨头Meta收购了AI社交网络Moltbook
Meta收购AI社交网络Moltbook,将其两位核心创作者招致麾下。Moltbook虽被指是‘赛博过家家’,但其建立的智能体验证身份并相互连接的系统机制,是Meta看重的核心价值。
微软深夜发布SambaY架构,Phi-4min加速10倍推理
微软基于Phi - 4 - mini微调出Phi - 4 - mini - Flash - Reasoning 3B模型,扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行速度比前代快10倍,有诸多优点。
北大开源统一世界模型框架:多类合成推理任务一套搞定
世界模型研究中,不同任务存在接口不统一等问题。北大DCAI课题组联合多方推出OpenWorldLib推理框架,整合多模态能力,构建标准化接口体系,在多任务上评估效果良好,降低研发门槛。
人类遗忘的难题解法,被GPT-5重新找出来了
GPT-5 Pro从埃尔德什问题定位到关键文献,发现该“未解决”数学难题早在2003年已被解决。此前网友曾热烈讨论此问题,此外,有教授称GPT-5 Pro能快速发现论文漏洞。
Transformer危!谷歌MoR架构发布:内存减半推理速度还翻倍
谷歌推出全新底层架构Mixture-of-Recursions(MoR),推理速度提高2倍、KV内存减半,首次在单一框架实现多任务处理与动态分配计算资源,研究人员通过实验验证其性能超Transformer。