「多步推理」共找到 5669 篇相关文章
押中 Figma、Scale AI 的 Thiel Fellowship, 今年下注哪些 AI 方向?
Thiel Fellowship 由 Peter Thiel 2011 年创办,为入选者提供资金与支持。2025 年入选者地域更广,项目聚焦 AI 等领域。热门方向有 AI Infra、金融 Infra、可编程生命系统,创始人年轻、跨界、实验性强。文中还介绍了多个亮点项目。
实证:现在的LLM根本不会Reasoning!
论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。
小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一
6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。
清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟
清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。
新DeepSeek R1代码能力直逼Claude 4!附生成任何优质网站的通用提示词
作者体验DeepSeek R1超8小时,发现其文本写作问题大幅修复,思维链推理改进,代码能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出写前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。
继LlaMa 辞职事件之后,微软被爆AI 部门裁员波及6000人!包括AI总监
微软突然宣布裁员约6000人,占全球员工总数3%,横跨多条产品线,AI总监也被裁。官方称是为集中资源,员工不满靠模型决定去留。同时,Meta的LLaMA团队也有人员离职,折射AI行业资金与人才的矛盾。
首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀
DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及降成本秘诀。
OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话
今天凌晨1点30,OpenAI开源医疗大模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示大模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。
扩散模型路线之争可以停了?Latent‑Pixel混合扩散生成新范式上线 | ECCV'26
中科大与智象HiDream.ai团队提出混合潜空间-像素空间扩散新模型Hi-DiT,解决了两类传统扩散路线各自的瓶颈,论文被ECCV 2026接收,在多个主流图像生成任务上取得优异性能,仅小幅增加计算开销。
用GPT-6 Astra就能直接控制机器人?可具身真机没那么简单
本文讨论GPT-6 Astra接入机器人控制取得亮眼单项成绩,但真机测试暴露不安全不稳定问题,介绍穹彻智能发布的开源RoboRSI多智能体自进化框架,解决具身智能落地核心痛点,探讨大模型时代具身智能行业的发展方向