「评分器」共找到 298 篇相关文章
你花80%精力调的AI,效果被 PDF 解析卡死了
做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。
自动驾驶优化:从复杂性到实时工程
本文深入探讨自动驾驶技术栈端到端架构,阐释从上下文感知传感器融合到MPC求解器等优化技术,如何将原始传感器数据转化为安全控制指令,还介绍轨迹规划、实时计算预算及调试等内容。
一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后
DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。
突破后训练瓶颈?Meta超级智能实验室又一力作:CaT解决RL监督难题
AI后训练依赖监督微调或程序化检查器,但很多有价值任务缺这两种资源。Meta超级智能实验室等机构研究者提出CaT方法,把推理时额外计算当教师信号,为大模型提供监督,实验显示效果显著。
英伟达的AI已经开始接管整个项目了?SATLUTION自主进化代码库登顶SAT竞赛
NVIDIA Research提出SATLUTION框架,将LLM代码进化能力扩展到完整代码库规模,能处理复杂项目。它协调LLM智能体对SAT求解器代码库迭代优化,在SAT竞赛中超越人类冠军,成本低且效率高。
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。
00后投身具身智能创业,剑指机器人界「Model 3」!已推出21个自由度灵巧手
具身智能创业公司灵初智能推出自研灵巧手,每只手21个自由度,操作能力强。其目标是将机器人整机价格打到17000美元,走‘Model 3式的产业破局之路’,还提出分层端到端算法解决训练难题。
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
仅靠5000+样本,全新强化学习范式让30B轻松击败671B的DeepSeek V3
传统强化学习在创意写作领域举步维艰,蚂蚁技术研究院联合浙江大学开源全新强化学习范式Rubicon,构建10000+条「评分标尺」,拓展应用至主观任务领域,其30B模型用5000样本超越671B的DeepSeek V3。
机器人手画圆圈,怎么就成为了一大难题了?
华人研究者 Tom Zhang 所在的 DaxoRobotics 团队推文称其机械手花两天画出圆圈,这或为机器人手首次画圈。该机械手用柔性手指夹笔画圆,靠肌腱控制,传统求解器难应对,还具超人类灵活性。