K2.6」共找到 2801 篇相关文章

开源动态8

CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B

上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。

OpenMMLab
7

一份最新具身智能中的世界模型&安全综述

本文分享2篇具身智能世界模型和安全挑战的综述。2025年10月的综述用三维坐标轴整合文献。还介绍世界模型分类、性能表现,围绕自动驾驶与机器人领域分析安全隐患并实证评估。

PaperAgent
开源动态8

推理速度10倍提升,蚂蚁集团开源业内首个高性能扩散语言模型推理框架dInfer

近日,蚂蚁集团开源业界首个高性能扩散语言模型推理框架 dInfer,在基准测试中,其将 dLLM 推理速度较 Fast - dLLM 提升 10 倍以上,攻克推理瓶颈,为开发者提供高效框架,推动扩散语言模型走向成熟。

机器之心
7

Sora2五天下载量破百万!超越ChatGPT增长速度,App Store免费榜霸榜第一

Sora2五天下载量破百万,增长速度超ChatGPT,在App Store免费榜霸榜第一。其虽有使用门槛,但热度高,盗版泛滥。不过它也面临版权问题,审核收紧。AI创意应用取代传统社交媒体速度加快。

量子位
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
新闻资讯7

马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI的尽头是卖薯片?

新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。

新智元
开源动态8

扣子官宣开源,掀桌大动作背后如何决策?扣子负责人独家披露

7月26日,字节将AI Agent平台「扣子(Coze)」旗下Coze Studio与Coze Loop开源至GitHub,采用Apache 2.0许可证。文章披露开源决策背后故事,探讨开源版目标、定位,以及团队对Agent开发未来的思考。

InfoQ
算法论文8

行业新突破:行为基础模型可实现高效的人形机器人全身控制

该综述聚焦行为基础模型(BFM)在人形机器人全身控制中的应用,梳理进展并分类算法,介绍应用与限制,还探讨未来研究机会与风险,有望引导该领域研究者和从业者。

机器之心
8

打脸OpenAI!谷歌Gemini高级版获IMO 2025官方认证金牌:纯自然语言端到端推理

谷歌DeepMind宣布高级版Gemini在2025年IMO中6题解5题获金牌,经官方认证,全程用自然语言推理。对比OpenAI自我宣称拿金牌,谷歌成绩更有说服力,还介绍了Gemini进步及实现方法。

AI寒武纪
开源动态8

微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行

今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。

AIGC开放社区