「多模型兼容」共找到 9855 篇相关文章
奖励是假的,能让Qwen提升25%性能却是真的!
华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。
告别先开发后治理:Agent 驱动的数据质量一体化交付
文章指出离线数据开发中数据质量建设面临开发与治理分离的困境,如治理滞后、迭代不同步等。DataWorks引入Data Contracts理念,以YAML Spec形式将质量规则嵌入开发流程,还可借助Agent配置规则,未来将多引擎覆盖、降低门槛并融入IDE。
独家:逐际动力前COO张力加入具身智能大脑初创企业BeingBeyond|甲子光年
「甲子光年」独家获悉,逐际动力前COO张力今年四月初加入具身智能大脑初创企业BeingBeyond。该公司聚焦模型算法,其Being - H系列模型成果突出。张力加入或使公司向可规模化运转转变。
地理学的AlphaEvolve?MIT斯坦福让AI自我生长、懂地理、懂世界
MIT和斯坦福学者提出GeoEvolve,把地理知识「嵌入」AI,让其成为能自主改进算法的科研合作者。它有双循环机制和四个核心模块,输入简单,开源为Python包,改进Kriging模型效果显著。
重磅!Claude Sonnet 4.5发布,可连续编程30小时,Claude Code同款构建工具也开放了
Anthropic发布Claude Sonnet 4.5,官方称是全球最强代码、复杂智能体构建及擅用计算机的模型。伴随产品全家桶升级,还开放Claude Code构建工具,发布Imagine with Claude。该模型能力强且更安全。
用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!
当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练改进AI模型,但用户可手动退出。它称此举因模型需更多数据,还拿微软等挡枪,却遭开发者吐槽。
开源 AI 视频平台
开源 AI 视频平台集成剪辑生成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务生成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。
动态RAG新工作:效果爆了,代码已开源
大语言模型幻觉问题突出,现有动态RAG方法信号不可靠。QuCo-RAG从预训练语料库挖掘统计证据,用客观频率替代主观置信度,实现毫秒级幻觉检测与动态检索触发,代码已开源。
百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!
当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。
一篇95页最新80种Deep Research系统全面综述
浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面剖析4种实现架构,如单体、流水线、多智能体和混合架构,并阐述各维度演变与进步。