人在回路」共找到 8750 篇相关文章

算法论文8

破解线长时序重建难题!纯视觉、单卡实时的公里级流式3D重建|CVPR'26

自动驾驶等领域,长序列3D重建落地难,存精度退化等问题。即将到来的CVPR 2026中,LongStream模型开源,它重新设计,解决了长序列难题,多基准测试表现强,推动3D视觉走向线建模。

量子位
算法论文8

LinearRAG:一种免关系提取的高效 GraphRAG 图构建方法

研究指出 GraphRAG 模型实际应用中表现常不如朴素 RAG 方法,原因是自动构建的知识图谱质量不佳。为此提出 LinearRAG 框架,有三大核心创新,四大基准数据集上全面超越现有方法,代码和数据已开源。

深度学习自然语言处理
开源动态8

微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1

微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。

AIGC开放社区
算法论文8

隐形束缚:RLVR为何无法突破LLM的推理边界?

大型推理模型进展依赖带可验证奖励的强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存“隐形束缚”,只能基座模型初始能力内优化,难以发现新解。

深度学习自然语言处理
新闻资讯8

刚刚,Sam Altman宣布:GPT-5即将发布

Sam AltmanX上宣布OpenAI通用推理系统2025年IMO达金牌水平,同时透露GPT - 5即将发布。OpenAI研究员Alexander Wei介绍突破细节,模型解决多道题获35分。GPT - 5是实验模型,有金牌能力的版本还需等待。

AGI Hunt
开源动态8

ICML 2025 | 长视频理解新SOTA!蚂蚁&大开源ViLAMP-7B,单卡可处理3小时视频

视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。

机器之心
新闻资讯8

专治Demo玩家:「具身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下

星动纪元凭借自研VLA具身智能模型,具身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下全球第一,展现全栈技术优势。

机器之心
新闻资讯7

咖啡机变聪明后,我连咖啡都喝不上了

一位科技记者用升级到Alexa Plus的博世咖啡机煮咖啡遭拒,社区也有诸多类似吐槽。生成式AI助手虽能力提升,但因LLM随机性,控制场景易翻车,新旧技术切换引发混乱,边界待明确。

机器之心
开源动态8

阿里通义新年礼物:开源最强Qwen-Image-2512版本告别AI塑料感与文字乱码

通义万相新年前发布Qwen - Image - 2512版本。它是开源界最强文生图模型,AI Arena盲测中表现出色。能消除AI塑料感,攻克文字渲染难题,还原真实世界和重构视觉元素逻辑排版上有显著提升。

AIGC开放社区
开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM