「多 Agent」共找到 6050 篇相关文章
OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案
OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。
ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速
上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。
光场显微飞跃AI时代!清华等首提SeReNet:毫秒级高分辨光场三维重建
SeReNet是物理驱动的自监督三维重建网络,能毫秒级实现高保真、高分辨光场三维重建,摆脱对标签数据依赖。它全链路建模应对复杂干扰,在多实验展现价值,推动生物成像技术发展。
中国造出一颗「不怕死」的AI大脑,专接最要命的活儿
全球首个搭载AI大脑的防爆机器人“若愚揽月01”接管加油站,其“若愚九天”机器人大脑深度整合多模块,采用双系统,实现“脑+体”合一,可迁移至多场景,成立三年成果显著,欲做机器人时代“智能内核”。
从开源狂热到应用为王,AI 正在回归常识
AI行业正发生变化,模型行业对“开源还是闭源”态度转向商业共识,旗舰模型开始闭源;应用变得更重要,应用层机会多;智能体重新定义AI价值边界,推动行业从“模型思维”走向“系统思维”。
生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收
现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。
免费使用!OpenAI发布ChatGPT记忆功能,秒变私人助理
今日凌晨,OpenAI联合创始人Sam Altamn宣布为免费版ChatGPT提供轻量级记忆功能,未来还会改进。该功能可根据用户对话习惯等个性化回答,对多领域帮助大,文中还介绍了其使用方法及常见问答。
开源2天斩获3K标星!开源TTS新星Chatterbox盲测击败ElevenLabs!
文本转语音(TTS)技术发展快,但达顶尖水平仍有挑战。开源TTS新星Chatterbox,开源2天冲上GitHub热榜,星标超3K。它功能亮点多,安装简单,适用于多种场景,性能超ElevenLabs。
TabClaw:让 AI 真正读懂你的表格数据
TabClaw 是面向表格数据的 AI 分析 Agent,能让 AI 真正读懂表格数据。它核心标签是全透明与持续进化,工作流分显式和隐式两层,目标是成为真正理解用户、能一起成长的表格分析伙伴,项目已开源。
本周推荐的6个超级6的Github开源项目!
本文推荐6个Github开源项目,有能接入多平台的开源微信机器人CoW,基于VS Code魔改的AI代码编辑器Void,免费的ERP系统ERPNext,开源物联网平台ThingsBoard,共享虚拟浏览器Neko,微软轻量命令行编辑器Edit。