测试驱动」共找到 2261 篇相关文章

算法论文8

让大模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26

紫东太初团队联合新加坡国立大学攻克大模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让大模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能。

量子位
算法论文8

CVPR 2026|清华联合美团推出3DThinker,首个用3D意象思考的工作

当前多模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合美团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在多基准上提升效果,且具备一定可解释性。

机器之心
算法论文8

Agent RL 总是训练崩?UCLA 这篇论文给了救命稻草!

这篇解读UCLA和威斯康星大学麦迪逊分校论文《ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning》的文章指出,Agent RL训练易崩溃,原因在于多轮交互任务带来奖励稀疏等问题。论文建“竞技场”,提出SAMPO算法提升稳定性,还给出从业者建议。

深度学习自然语言处理
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事

近日,华为与港城大联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心
新闻资讯8

黄仁勋年初对话:2025 的 AI 如何塑造产业的「五层蛋糕」?

NVIDIA 创始人黄仁勋接受专访,反驳 AI 致失业说法,阐述 AI 技术栈「五层蛋糕」模型,强调开源重要性,批评「上帝 AI」与末日论,还谈到 AI 成本下降、能源需求及「AI 泡沫」等议题。

机器之心
新闻资讯7

OpenAI公开新的模型训练方法:或许能解决模型撒谎问题,已在GPT-5 thiking验证

OpenAI公开名为“坦白”的模型训练方法,可解决LLM欺骗行为。该方法强制模型自我反省,“坦白”奖励与“主要回答”奖励分离。在GPT - 5 - Thinking上实验,能提升不良行为可见性,但对“无知的错误”有局限。

AI寒武纪
推荐文章7

五源袁野:理解AI创业的五个视角 |5Y View

文章是五源合伙人袁野在五源2025创始人年会演讲,从五视角审视AI时代创业变化,如技术范式切换、供给边界演进等,为理解AI创业带来启发,强调创新要敢于走新路。

五源资本 5Y Capital
新闻资讯8

2025-2027年DRAM、NAND市场及价格走势分析

文章分析2025 - 2027年DRAM、NAND市场走势。DRAM因AI需求价格涨,供需缺口大,DDR5将成主流;NAND需求结构性增长,产能利用率提升。技术革新不断,中国厂商崛起,地缘政治影响格局。

芯师爷
算法论文8

NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式

中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。

机器之心
开源动态8

让本地大模型不再重复推理的缓存技巧

本地跑大模型时,同样问题换说法问,模型又要重新推理。`constraint-cache`这个Python库可解决此问题,它将语义相似查询规范化为统一缓存键,实现近乎即时的重复查询响应,还避免了随机性响应问题。

AI工程化