「多体交互」共找到 601 篇相关文章
美团新独立APP,点不了菜只能点AI
美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其迭代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。
李飞飞自曝详细创业经历:五年前因眼睛受伤,坚定要做世界模型
在a16z播客节目中,“AI教母”李飞飞讲述创业经历。五年前眼伤失立体视觉,让她意识到其对空间交互的决定性作用。她认为真正通用智能需理解物理世界,与Martin Casado一拍即合创立World Labs,加速世界模型突破。
用3万小时触觉数据补齐具身智能「手感」,新智具身联合复旦大学统一触觉「方言」
新智具身联合复旦大学发布三份技术报告,将触觉跃升为具身智能核心基建。构建3万小时交互语料库统一触觉“方言”;提出新方案让机器人提前预判触觉;在世界模型中重构“触觉想象”,推动具身智能“视触融合”。
2亿多人开始和AI打电话,他们在聊什么?
2025年12月豆包月活达2.27亿,越来越多人与它语音通话。此前AI语音交互存在问题,豆包升级为全双工模型,体验更像打电话。作者实测其在不同场景表现出色,还分享使用技巧,并对比了和ChatGPT语音的优劣。
发生在CES的六场对话:来自深圳的 AI 硬件“外卷”
2026年CES上,中国硬件力量涌向全球。虽有地缘政治摩擦、签证障碍,但全球市场仍看好中国AI硬件。大厂将边缘硬件定义为AI生态入口,初创公司从数据、场景、交互寻生存之道,机器人应用场景也更明确。
7 小时连续重构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程重大突破
9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,能连续工作7小时完成复杂重构。
开源的 V0/Lovable 替代方案Libra AI
Libra AI是面向生产环境的AI原生开发平台,可通过自然语言交互管理Web应用全生命周期。它功能丰富,如AI智能编码、集成开发体验等。其开源有技术自主、架构灵活等好处,还介绍了技术架构、上手方式与部署方案。
比RAG高出8.9%,百度TURA:让搜索引擎“动”起来的下一代AI Agent架构
现有检索增强生成(RAG)系统只能读取已索引的静态网页,无法满足用户需实时数据的问题。百度TURA用工具调用把RAG升级为动态交互,其核心分检索、规划、执行三步,已在百度亿级流量场景跑通。
VLA爆发!从美国RT-2到中国FiS-VLA,机器人「即知即行」的终极进化
2025年具身智能爆火,VLA模型成核心。从美国RT - 2到中国FiS - VLA,VLA硬核进化。谷歌、微软等有重要成果,中国智平方等企业也不断创新,FiS - VLA性能超现有方法,VLA正重塑机器人与人类交互未来。
美团开源全模态,比肩顶级闭源模型,开源新SOTA
美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。