新算法框架」共找到 5200 篇相关文章

算法论文8

哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL

论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开视角。

深度学习自然语言处理
算法论文8

RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供方向。

机器之心
产品应用7

Git for Data: 像 Git 一样管理你的数据

传统数据恢复手段在AI时代耗时费力,Git for Data带来变革,具备版本控制、快速回滚等能力,是AI时代数据管理范式。MatrixOne数据库已具备其核心能力,未来将持续增强相关特性。

InfoQ
新闻资讯7

GPT-5:我更强了,就这?“看不见”的升级

OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。

MacTalk
新闻资讯7

稚晖君,昨夜冲进了科创板

智元机器人联合创办者稚晖君名气大,公司创办不到3年融资数十亿、估值破百亿。7月9日,其相关主体完成对上纬材63.62%的控股权收购,不走IPO,完成通向公开资本市场关键一步。

量子位
开源动态8

彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统

大语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。

新智元
产品应用8

比10年专业医生准4倍!微软发布突破性医疗AI系统

微软首席执行官分享发布的医疗AI系统MAI - DxO,它模型无关,能适配不同语言模型,模拟医生诊断流程。测试显示其准确率远超专业医生,成本大幅下降。此外还发布序贯诊断基准SDBench。

AIGC开放社区
算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。

机器之心
新闻资讯7

DeepSeek版R1直追OpenAI o3!实测来了:“小版本升级”着实不小

DeepSeek在端午节前更R1版本DeepSeek - R1 - 0528,看似小版本更实则提升巨大,在LiveCodeBench上几乎与OpenAI o3 - high相当,实测显示编程等能力显著优化,直追闭源模型。

量子位