「消费级机器人」共找到 1844 篇相关文章
谷歌开源新Deep Research范式,教Agent学会真正的思考。
周末谷歌发博客讲Deep Research,它重新定义一些Agent常见范式。现在多数Agent模式缺全局观,谷歌让AI先打草稿再迭代修正。新框架含技巧,在多任务上超OpenAI,已可试用。
小红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!
近年来TTS技术爆发,但多人对话的自然流畅性和长序列稳定性一直是难点。小红书团队开源的FireRedTTS - 2是面向多人对话场景的TTS模型,实现自然切换和低延迟,支持多语言,适用于多种场景。
Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略
Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。
人类下一个奇点,超级智能时代
OpenAI联合创始人Sam Altman在博客《温和的奇点》中表示,人类已越过技术转折点,迈向数字超级智能时代。他预测2025 - 2027年将有系列智能成果出现,到2030年代智力和能源将丰富,虽有挑战但前景乐观。
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
李飞飞发布Atlas,世界模型进入新时代
李飞飞创业公司 World Labs 发布新一代世界模型 Atlas,它是全模态模型,能处理四模态数据。其核心为空间上下文设计,评测成绩不错,应用场景丰富,公司发展节奏密集,产品路径有转向。
史上最大IPO要来了
据英国《金融时报》,全球头部AI企业Anthropic最快10月上市,估值或达2万亿美元,将超SpaceX成史上最大IPO。其营收增长快,靠编程等企业级业务逆袭,还引得众多科技资本下注。
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测
近年来,VLA模型成通用机器人控制重要路线,但模型大、动作更新慢的矛盾凸显。华中科技大学联合华为提出TurboVLA,绕开大语言模型,形成V+L→A路径,降低成本,保持操作能力。
迈向长程智能体,人大高瓴发布149页全景综述
新问题出现,长程智能体研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能体统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。
SFT「不完全学习」之后,研究的下一个前沿在哪?ACL 2026 腾讯混元论文未来方向展望
本文从不完全学习现象出发,展望SFT领域未来研究方向,如未知根因探索、检测方法改进等,还提及推广到其他训练范式、CPT精细化研究等,给出研究优先级和社区建议。