「多智能体推理能力」共找到 7095 篇相关文章
ChatGPT 为什么越来越“懂你”?一文解析它背后的记忆机制
今年4月,OpenAI对ChatGPT记忆系统重磅升级,可参考过往对话提供个性化响应。软件工程师Eric Hayes拆解其双重记忆架构,推测实现机制,探索对用户体验的重塑。
高精度全身操控!从文本输入生成全身操控物体的动作
物体操控的整体动作生成是具广泛应用但极具挑战的任务,核心挑战在于手部与身体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。
无需 OCR 就能从各类文档中提取结构化信息的本地化开源工具docext
docext是无需OCR的本地化开源工具,能从发票、护照等文档图像提取结构化信息。智能文档处理排行榜评估VLMs在多任务表现,docext有灵活提取、表格提取等功能。
多模态技术爆发元年,行业应用如何落地?
InfoQ《极客有约》X AICon 直播栏目,邀上海交大赵波、快手高欢、腾讯邵帅探讨多模态大模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先大后小蒸馏提效,垂直模型现阶段更优。
Anthropic这回撒钱了!Claude Code最高白送250美元
本文报道Anthropic推出正式版Claude Code云端会话功能,为符合条件的老用户发放最高250美元免费赠额,推广云端离线跑代码新能力,介绍了活动规则、功能特点及业内讨论。
直击2026骁龙峰会:2nm旗舰首秀,但Agent正在重塑骁龙|甲子光年
本文是甲子光年发自2026高通骁龙峰会的现场报道,高通发布全球首款2nm工艺旗舰移动平台,同时披露其面向Agentic AI重构芯片架构、布局跨终端AI计算底座的完整战略,深度分析了端侧Agent落地的技术挑战与生态进展。
实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”
本文是对千问最新推出的Qwen3.8-Omni-Flash全模态模型的实测,该模型大幅降低全模态Agent使用成本,API价格远低于竞品,开放1M上下文免费测试额度。
复杂的Harness Evolution,甚至不如多跑几遍
本文解读AI2与华盛顿大学最新研究,针对热门Agent Harness Evolution方向,通过公平对照实验检验方法真实收益,戳破研究误区,引发对Agent评估标准的反思。
传统企业 AI 转型的最短路径,藏在研发部门
文章指出在AI时代,传统企业研发部门正从成本中心转变为AI转型发动机。分析转型从研发出发的原因,介绍传统企业转型面临的难题及Agent的作用,还通过海信、三一重工、孩子王案例展示AI应用路径。