长文本推理」共找到 2830 篇相关文章

算法论文8

打破视频理解瓶颈:HoPE混合位置编码提升VLM度泛化能力

如今视觉语言模型在上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM度泛化能力。

机器之心
算法论文8

突破通用领域推理的瓶颈!清华NLP实验室强化学习新研究RLPR

现有基于可验证奖励的强化学习(RLVR)应用范围局限,清华自然语言处理实验室提出 RLPR 技术,通过 Prob - to - Reward 提高概率奖励质量,有领域无关等特点,相关代码等已开源。

机器之心
算法论文7

让推荐学会思考:用强化学习激活大模型的序列推理能力

文章指出推荐系统曾未紧密结合大模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练大模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。

AI科技评论
新闻资讯8

世界模型来了因果技术标杆!具身大脑真要脑子了

具身智能有泛化能力瓶颈,构建‘世界模型’成热门赛道。Aether AI获2000万美元种子轮融资,走因果世界模型路线,创始人黄碧薇认为这是世界模型‘终局形态’,能让机器人理解物理规律。

量子位
开源动态8

英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍

英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。

新智元
开源动态8

国产GPU首获全球顶级推理框架「原生门票」:MUSA合入SGLang主线

近日,摩尔线程举办「SGLang × MUSA Meetup」,分享与 SGLang 社区及 MUSA 生态协同进展。其 MUSA 后端已加入 SGLang 官方支持体系,代码合入主线,还在多方面取得成果,众多开源项目核心维护者参与探讨国产 AI 算力。

机器之心
新闻资讯8

Demis Hassabis:AGI 还缺什么,智能体到底行不行,下一个科学突破什么样

Google DeepMind CEO Demis Hassabis 做客直播,探讨当前 AI 范式距 AGI 差距、智能体水平、科学突破模式等话题。指出当前范式或需关键突破,记忆方案待优化,AlphaGo 技术复活,还给出创业建议。

宝玉AI
开源动态7

YC总裁开源个人AI记忆系统GBrain:让你的OpenClaw/Hermes脑子

YC总裁Garry Tan开源GBrain,这是经实战检验的AI记忆中枢。它有真实数据规模、混合搜索架构等特点,核心工作流含实体检测等。技术选型有考量,还提供体验方式和技能包文档。

AI工程化
算法论文8

攻克文档与多模态挑战,Paper2Video实现学术视频的自动化生产

新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动化生产,实验显示其在多方面表现佳,效果接近人工水平。

机器之心
算法论文8

Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品

尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。

机器之心