「小模型推理能力」共找到 9427 篇相关文章
AI Agent也有体检中心了?诊断级安全框架AgentDoG正式开源
上海人工智能实验室今日开源全球首个具深度诊断能力的AI智能体安全护栏框架AgentDoG。它能精准定位风险、解释决策成因。团队提出三维风险分类法,构建数据合成管道,实验表现领先,还集成归因模块。
具身AI当立!这是我分析完7篇最新Paper得出的结论~
作者分析7篇来自蚂蚁、小米、高德的具身AI论文,认为行业要变天。蚂蚁打通全链路并开源,小米让VLA在消费级显卡跑,高德重构数据和架构。具身AI正从‘手工业’走向‘工业革命’。
GLM-5架构曝光,智谱两日涨60%:采用DeepSeek同款稀疏注意力
GitHub代码确认GLM - 5架构细节,它采用DeepSeek - V3/V3.2架构,含稀疏注意力和多Token预测,参数量745B。OpenRouter上神秘「Pony Alpha」被指是其测试版,受消息影响智谱AI港股两日涨60%。
机器人成精了?Figure 03下厨房,不经意关抽屉那一下,太像人了
新智元报道,Figure AI推出搭载Helix 02系统的机器人Figure 03。视频中它在厨房自主干活,如用胯顶抽屉、用脚抬门,还展现多核心能力。其突破传统难题,实现行走与操作统一,能胜任家庭细活。
从 Chat 到桌面 Agent:我在一台旧 Windows 上,看见了办公的未来
本文作者作为Mac老用户,为体验昆仑天工研发的Skywork桌面Agent,找来旧Windows电脑测试。该产品定位是接管电脑工作世界,解决办公任务处理和安全隐私问题,还介绍了其功能和使用效果。
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
未来两年软件工程展望:从写代码到管 AI,程序员正分化成两种职业
软件行业处在转折点,AI 推动编程变革,企业更重效率。文章围绕五个关键问题展望 2026 年软件工程,分析初级开发者、技能、角色、专家与通才、教育等问题的不同情景,还给出应对建议。
Clawdbot 深度拆解: 7 个问题看懂它。
近日,AI技术圈焦点是开源项目Clawdbot(已改名Moltbot)。它是“全天候Jarvis”,GitHub星标超8万。本文深度拆解,介绍其概念、对比同类、分析独特魅力、创意场景、安装配置、运行原理及面临的挑战。
AI记忆革命爆发!Clawdbot如何像大脑般记住一切
2026年初开源个人AI助手Clawdbot引爆社区。它可本地运行、集成聊天平台、自主处理任务,有长时记忆和任务执行能力。AI研究工程师Manthan Gupta复盘其记忆机制原理,涉及上下文、记忆存储、搜索等内容。
168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案
Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。