人在循环中」共找到 8829 篇相关文章

算法论文8

港大×复旦×上交:视触觉融合+闭环纠错,让机器双臂协作不再「盲操」

港大联合复旦、上交大提出TAMEn,UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器学得更快准高效,双臂协作任务中提升成功率。

量子位
算法论文8

何恺明带大二本科生颠覆扩散图像生成:扔掉多步采样和潜空间,一步像素直出

何恺明团队提出新方法Pixel Mean Flow(pMF),突破传统扩散模型/流模型限制,砍掉多步采样和潜空间,一步像素空间生成图像,ImageNet不同分辨率上取得佳成绩,还介绍了核心设计、实验结果对比等。

量子位
新闻资讯7

真实音频场景,大模型集体挂科!首个原生语音基准MultiChallenge

Scale AI发布首个原生音频多轮对话基准Audio MultiChallenge,撕开大模型靠合成语音评测维持的假象。实验显示,Gemini 3 Pro等模型真实场景表现不佳,还揭示了模型语音交互中的三大失败模式。

新智元
开源动态7

Rex-Omni:用 3B 模型颠覆目标检测

长期目标检测依赖传统坐标回归模型,MLLMs方法存不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。

带你学AI
新闻资讯7

GPT-5几个预测:用户翻倍,编程登顶,屠杀一众模型

OpenAI发布GPT-5,登顶大模型测评榜单。它有统一智能架构,多测试取得突破,编程能力强击败对手。还改进意图,减少幻觉、增加情感、健康领域更实用,价格便宜。作者预测其将带来用户翻倍等影响。

鲸选AI
新闻资讯7

谷歌 DeepMind 发布机器学基础模型 Gemini Robotics On-Device

谷歌 DeepMind 推出 Gemini Robotics On-Device,这是视觉 - 语言 - 行动基础模型,可机器硬件本地运行,低延迟且能针对特定任务微调。它是 Gemini Robotics 家族最新迭代,还发布相关基准测试。模型待广泛可用,SDK 可 GitHub 找到。

InfoQ
产品应用8

AI 集成的智能 Profiling 实践:从性能分析到优化闭环

本文由韩钦亭撰写,分享了已有 Profiling 平台引入 AI 智能辅助模块的实践。介绍了设计思路、工程实现、应用成效,对比不同大语言模型,通过实际案例展示优化效果,还探讨了 AI 性能优化场景的未来潜力。

InfoQ
产品应用7

一群年轻,正训练AI宠物的灵魂 | 甲子光年

文章讲述了芯宠工场团队训练AI伴宠Lito的过程。通过各种试验,Lito能做出预设外反应,其‘灵魂’类互动中生长。团队面临功能与情感的抉择,市场上也有其他创业者挖掘AI情感陪伴赛道。

甲子光年
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,多基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
新闻资讯8

谷歌最新 Gemini Agent 爆击GPT-5.2?类最后考试得分见分晓!网友:Altman又该发“红色警报”了

全球工智能竞争升温之际,谷歌与 OpenAI 同日更新。谷歌推出全新 Gemini Deep Research 工具,能力提升显著,还开源基准、推交互 API;OpenAI 发布 GPT - 5.2。两者竞争激烈,差距微小,都争夺智能体框架标准主导权。

AI前线