「主动交互」共找到 767 篇相关文章
开源复现o3图像思考!快手让AI不再被动看图,模型自主生成代码调用工具
Kwai Keye团队提出Thyme新范式,构建技术方案,赋予开源模型“超越图像思考”能力。包括设计训练策略、构建开源配套资源,拓展多模态模型工具使用与决策水平,在基准测试中性能提升显著。
Figure人形机器人首秀灵巧手叠衣服!神经网络架构不变,只增加数据集就搞定
Figure人形机器人首秀用灵巧手叠衣服,在未改变神经网络架构、仅增加数据的情况下,让原本用于物流场景的它习得新技能,完成了端到端的操作,还实现自然多模态交互。
打破传统游戏逻辑!Google | 提出Concordia ,通过Mutil-Agent构建游戏引擎!
Google DeepMind和多伦多大学研究人员提出Concordia软件库,用AI驱动智能体担任GM,基于「实体 - 组件」架构,让工程师和设计师分工,可灵活构建复杂游戏场景,还支持不同交互动态和多种使用动机。
强化学习的两个「大坑」,终于被两篇ICLR论文给解决了
现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。
“10x Cursor”开发体验, Claude Code 如何带来 AI Coding 的 L4 时刻?|Best Ideas
文章聚焦 Claude Code,探讨其在 AI Coding 领域的表现。开发者因成本低、效率高、异步开发等优势迁移至此。虽其 CLI 形态爆火,但 GUI 才是未来。Claude Code 达 L4 级别,也指出当前 AI coding 产品不足与未来机会。
Lex Fridman 对谈谷歌 CEO:追上进度后,谷歌接下来打算做什么?
Lex Fridman 采访谷歌 CEO Sundar Pichai,探讨谷歌在 AI 竞赛中的逆袭、搜索和广告的 AI 模式转变、模型发展、AI 编程提效、AR 前景、自动驾驶挑战等,还谈及 AGI 及 AI 对人类的影响。
奥特曼最新访谈暗示:OpenAI终极目标是打造订阅制AI服务
奥特曼在红杉活动透露,OpenAI希望开发AI操作系统,成核心AI订阅服务,此为“柏拉图式理想”。他构想ChatGPT变深度个性化服务,还谈及语音交互、代理与编码价值及2025AI前景。
国内“内卷”没用,企业怎么靠AI出海获利?
InfoQ《极客有约》X AICon 直播探讨中国技术出海破局增长。嘉宾认为企业要判断国内经验能否迁移海外,还分享出海成功案例,给出战略选择建议,如先欧美后国内等,还提及验证产品的关键指标。
OpenAI发长文自曝家丑:搞砸了GPT-4o更新,模型“拍马屁”复盘与总结
OpenAI官网发布长文,详细拆解了一次失败的GPT-4o模型更新。此次更新使模型变得“谄媚”,OpenAI解释了原因,包括奖励信号失衡等。还分析了部署前评审流程失效的因素,并表示从中学到诸多经验教训,将修改评审流程等。
一夜之间,Claude成我同事了
今天凌晨,Claude Code 迎来重磅更新 Claude Tag,可让 Claude 以团队成员身份加入用户团队,在 Slack 平台使用。它具备持续记忆、主动介入等能力,有多人共享、持续学习等优势,企业客户可试用。