「思维工具」共找到 2149 篇相关文章
蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新机器人
蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小时真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。
刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想
本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。
Claude自己写出Claude!2小时干完两月活,人类在工位上多余了?
Anthropic推出的AI办公利器Claude Cowork引发关注。它能两小时干完两个月的工作,代码由Claude Code自己编写。该工具应用广泛,让人类面临职业价值拷问,也可能成为今年AI应用层趋势。
专为“超大模型而生”,新一代训练引擎 XTuner V1 开源!
9月8日,上海AI实验室开源书生大模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超大规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。
多模态模型学会“按需搜索”,少搜30%还更准!字节&NTU新研究优化多模态模型搜索策略
字节与NTU优化多模态模型搜索策略,通过搭建工具、构建数据集及设奖励机制,用强化学习训练模型,使其按需搜索。实验显示,MMSearch - R1系统少搜30%还更准,为多模态大模型发展提供洞见。
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」
本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。
智能体时代,人类与AI如何分工?
本文围绕智能体时代人类与AI的分工展开,探讨工作模式、技能需求等变化。指出智能体使工作时空重构、原子化,挑战传统职业身份,还使工作与生活边界模糊,同时强调人类需掌握系统思维等元技能与智能体协作。
软件开发人员认为无需关注却可能会影响其工作的那些事
在哥本哈根Goto大会上,Holly Cummins呼吁开发人员关注常被忽视却影响工作的问题。她以眼镜蛇问题等为例,强调设计决策可能有意外后果,提倡系统思维、统计素养,还提及并发技术和AI对就业市场的影响。
模仿人类推理修正过程,阶跃星辰提出形式化证明新范式 | 开源
阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。