「跨具身学习」共找到 2510 篇相关文章
下一代目标检测模型:3B参数MLLM Rex-Omni首度超越Grounding DINO,统一10+视觉任务
IDEA研究院团队用3B参数的Rex - Omni打破MLLM目标定位精度僵局。它统一视觉任务,结合坐标编码与强化学习,在多项检测基准超Grounding DINO等,解决定位和行为缺陷,为MLLM成下一代检测模型提供方案。
更会聊天、主打情绪价值,OpenAI 发布 GPT-5.1
今天凌晨,ChatGPT 模型升级为 GPT-5.1,官方主打更智能、更具对话性。它有 GPT-5.1 Instant 和 GPT-5.1 Thinking 两个子模型,本周内逐步向所有用户免费开放。升级重点在模型能力和个性化设置。
OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话
OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。
谷歌192亿买他回来,现在只想让他闭嘴
谷歌花27亿美元挖来的Transformer“贡献最大”作者Noam Shazzer,因在公司内部论坛发表极具争议的言论,点燃“火药桶”。谷歌管理方删帖使争议升级,外界联想起2017年“James Damore事件”,但Noam地位重要,谷歌难以将其开除。
RL成本降幅超90%!Meta提出Agent训练新范式DreamGym
传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。
AI圈再颠覆!中国AI翻译耳机通话翻译,实测震撼
科大讯飞发布全新AI翻译耳机,上海与迪拜连线对话实测表现震撼,响应延迟低至两秒。其集成“端到端语音同传”技术,采用“骨导+气导”设计。此外,翻译机2.0也升级,科大讯飞在AI翻译领域优势显著。
腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型
腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。
讲座分享 | 密歇根大学Karthik Duraisamy教授
密歇根大学Karthik Duraisamy教授将开展讲座,主题为数据驱动的湍流建模。会介绍过去十年嵌入学习模型增强的进展,强调简约与约束平衡,指出存在的陷阱及挑战,还提及让数据驱动封闭成为可靠组件的要点。
奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队
GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是大飞跃,年轻人要掌握AI工具,还提出评估大模型智力新指标等。
社区供稿丨揭秘端到端文档OCR模型 POINTS-Reader
腾讯开源端到端文档OCR模型POINTS-Reader,论文被EMNLP 2025主会录取。它提出可扩展数据生成方案,具简洁、性能好、高吞吐量等特点,通过两阶段训练方案解决依赖蒸馏数据问题,在多基准测试表现佳。