「人类推理」共找到 3096 篇相关文章
刚刚,全球首个AI科学家登上Nature!包揽提出idea到写论文全流程,已通过人类盲审
历经一年半研发,Sakana AI联合多高校打造的AI科学家系统登上Nature杂志。该系统能自主完成科研全流程,代码和论文已开源。还介绍了自动审稿人、缩放定律,也指出其局限,引发伦理探讨。
灵宝 CASBOT 与 CASIA 共同提出“增强物理人机协作中的人类意图估计和人机角色分配”方法
近日,ICRA 2025 在美国亚特兰大开幕,中科院自动化所与灵宝 CASBOT 提出的“增强物理人机协作中的人类意图估计和人机角色分配”方法获录用。该方法解决现有问题,实验显示优势明显,有巨大应用潜力。
AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星
香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。
亿级日活App的“算力生死劫”:推理成本倒挂,他们靠跨云架构砍掉75% GPU集群
一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本高,ARPU远低于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降低成本,采用跨云架构过渡,实现零阵痛平替。
《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造
研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。
深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4
深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。
一个省略号提示+强化学习搞定大模型“过度思考”,中科院自动化所新方法:从强制推理到自主选择
中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理大模型依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。
每天审200个PR、每月3000个Issue?智能体开始并行写代码,人类可能成最薄弱环节
本文是对微软 VS Code 团队工程经理 Kai Maetzel 的访谈。他回顾了 VS Code 发展历程,分享 AI 编程、智能体开发及开发者工具设计的实践思考,如 AI 补全体验优化、智能体开发权衡、与 IDE 交互机制等,还探讨了未来发展挑战与趋势。
自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。
AI将消灭中产阶级!前谷歌高管惊人预警:未来只剩金字塔尖0.1%和底层
前谷歌X高管Mo Gawdat警告,2027年起AI将开启15年“地狱模式”,大批白领失业,中产阶级消失,只剩0.1%富人和底层。之后将进入AI主导的乌托邦时代。他认为邪恶人类应被AI取代,人类需将权力交给AI。