通用多模态推理」共找到 3315 篇相关文章

产品应用7

GPT-5 不是技术新范式,是 OpenAI 加速产品化的战略拐点

文章从不同视角评价 GPT - 5,指出它是 ChatGPT 产品重要升级,是 Router 驱动系统。介绍其能力提升与短板,如 Vibe coding 性价比高但 Agentic 能力不足,还探讨了商业影响、价格战等,期待其 Agentic 能力发展。

海外独角兽
算法论文8

超低标注需求,实现医学图像分割!UCSD提出三阶段框架GenSeg

GenSeg用AI生成高质量医学图像及对应分割标注,在仅有几十张样本时也能训练出媲美传统深度模型的分割系统,显著降低医生手工标注负担。它是通用、与模型无关的框架,可集成到现有分割模型。

新智元
开源动态8

3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门大学

上海AI Lab和澳门大学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。

量子位
产品应用8

谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”

谷歌DeepMind推出第三代通用世界模型Genie 3,能生成多样化交互式环境,可实时导航。它较前代有诸多突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。

AI寒武纪
推荐文章7

拥抱 AGI 时代的中间层⼒量:AI 中间件的机遇与挑战

文章指出大模型发展呈能力跃迁、生态开放趋势,推动AI应用从聊天机器人向组织级智能体演进。AI中间件可解决应用工程化挑战,但面临上下文管理、记忆更新等难题,短期助力应用规模化,长期或成组织智能“神经中枢”。

InfoQ
新闻资讯7

Switch的救世主是老黄!?

Switch2发售,其内置图形API NVN2亮相。NVN2让Switch2表现更优,应对3A大作轻松。NVN2背后是任天堂与英伟达十年合作,NVN去除通用功能减少开销,NVN2增加新特性让画面更精致。

量子位
开源动态8

具身智能大脑+首个SaaS开源框架,智源研究院刷新10项测评基准,加速群体智能新范式

智源研究院推出通用具身大脑RoboBrain 2.0与全球首个具身智能SaaS开源框架RoboOS 2.0并全部开源。前者突破主流AI模型瓶颈,后者实现大脑云端优化与小脑技能免适配注册,降低开发门槛。

量子位
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

时隔5个月,xAI发布通用模型Grok 4,后续还将推三款模型。Grok 4上线,有三个订阅版本。马斯克称其智能超博士生,多项基准测试领先,编码或超Cursor。其性能强大源于训练投入和计算扩展。

AI前线
新闻资讯7

Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 和Gemini的20%

API开发者曝光Grok - 4和Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3和Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。

AGI Hunt
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理