和差集」共找到 7385 篇相关文章

算法论文8

腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”

视觉语言模型(VLMs)存在视觉幻觉语言捷径问题,限制其可靠性泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解自我奖励机制,不依赖外部监督,提升模型视觉感知推理可靠性。

深度学习自然语言处理
开源动态8

英伟达开源全新大模型:黄仁勋不想只「卖铲子」

2025年底英伟达宣布开源全新模型家族Nemotron 3,含Nano、SuperUltra。它融合Mamba、TransformerMoE技术,有诸多创新。这不仅是产品更新,更是战略突袭,标志着英伟达想构建AI闭环开放生态。

新智元
算法论文8

微软 & UT Dallas 联手揭秘:从 SFT 到 RL 的进阶之路

微软与 UT Dallas 合作论文揭秘大模型做漏洞检测从 SFT 到 RL 的后训练流程,构建 C/C++ 漏洞数据跑通全流程,总结六大‘避坑’指南,还开源整套框架、数据模型。

深度学习自然语言处理
算法论文8

DeepMind爆火论文:向量嵌入模型存在数学上限,Scaling laws放缓实锤?

DeepMind一篇关于向量嵌入局限性的论文在AlphaXiv爆火。其证明向量嵌入有数学上限,Scaling laws或放缓。研究构建LIMIT数据,测试发现即便是先进嵌入模型也难解决简单任务,揭示了RAG系统约束,让人反思Scaling Laws边界。

机器之心
新闻资讯8

OpenAI最新开发者“全家桶”:Apps SDK、Agent Builder、ChatKit深度解读与实测

长假期间,OpenAI在2025 DevDay宣布开发者生态重大升级,引入“Apps in ChatGPT”及其SDKAgentKit工具。文章深度解读Apps SDK、Agent Builder、ChatKit,介绍功能、使用方法体验,还提及OpenAI的AI大平台战略。

AI大模型应用实践
算法论文8

解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!

近年来,LLMAgent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务两个数据揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。

深度学习自然语言处理
算法论文7

人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架

人大、清华腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据、设计LoRA结构、统一架构,训练分预训练指令调整两阶段。

CourseAI
算法论文8

冷门新语言AI写不动?IEEE论文:从零到及格线,MoonBit给出完整训练路线

IEEE论文聚焦新语言MoonBitGleam,探讨大模型代码生成能力。研究发现大模型零样本生成新语言代码能力,few - shotRAG有提升但有限,继续预训练及指令迁移可显著提高模型表现。

量子位
新闻资讯8

重磅!OpenAI深夜发布ChatGPT Agent:AI打工人正式上线「附发布会全程视频」

OpenAI推出ChatGPT Agent,它整合Operator远程浏览器Deep Research能力,Pro、PlusTeam用户可激活。能完成复杂任务,有强大工具,性能在多基准测试超人类,但OpenAI因能力增强启动最高安全保障。

AI寒武纪
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型9个主流数据,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心