「自主推理能力」共找到 4957 篇相关文章
让大模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026
复旦、创智联合推出RSAgent,让多模态大模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产
5月25日,华为何庭波在ISCAS 2026上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片晶体管密度达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。
Harness 工程实践复盘:100% Cache 命中的 Agent 怎么设计?
本文是 ClackyAI 团队在 Harness 工程实践上的复盘。他们经两代失败后用 Ruby 重写第三代 OpenClacky,总结影响成本和效果的 7 个关键决策,如双 Cache 标记、System Prompt 字节冻结等,凸显 Harness 工程对 Agent 产品的重要性。
AMD 苏妈对话李开复:AI 转型只能由 CEO 驱动、未来“DRI”(直接负责人)将是企业核心|直击现场
2026 AMD AI 开发者日上海站,AMD 苏姿丰阐述 AI 愿景及中国战略。她与李开复对话,李开复认为 AI 跨越编程临界点,多智能体架构是突破,AI 转型需 CEO 驱动,未来 DRI 将成企业核心。
小模型代替顶级闭源:微软用4B小助理,砍掉30% Token消耗
微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。
国产GPU组了个开源局,把SGLang等核心开发者都摇来了!
国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入大模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。
OpenClaw低调更新重磅版本,龙虾长手长脚了
OpenClaw开发者Peter带来Computer Use工具Peekaboo v3版本,解决了Agent类产品无法直接操控桌面的问题。它能实现像素级截图、读取UI位置,还能完成各类操作,支持自然语言指令,有四种使用方式。
开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具
FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。
全球首个世界统一模型发布,机器人家庭成员来了!
自变量机器人发布全球首个世界统一模型架构的具身智能基础模型WALL - B,它打通视觉、听觉等模块,让机器人理解物理世界。还让机器人拥有多能力,通过真实家庭数据形成数据飞轮,助力其融入家庭。