「R1论文」共找到 2704 篇相关文章
一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了
谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。
模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一
上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。
仅凭一篇博客,他成功入职OpenAI!核心技术或用于GPT-5训练
Keller Jordan设计Muon优化器并公开研究进展,引OpenAI和xAI关注,最终加入OpenAI。Muon性能卓越,或用于GPT - 5训练,其故事暗示传统论文模式在AI领域或已落伍。
天文预测新SOTA!紫东太初&国家天文台联手攻克恒星耀发难题
紫东太初与中国科学院国家天文台联合开发天文耀发预测大模型FLARE,能精准预测恒星耀发事件。该模型整合恒星物理属性和历史耀发记录,提升预测准确性,相关论文被IJCAI 2025录用。
最懂科学的开源基础大模型『书生-S2』发布:科学能力比肩顶尖闭源,通用性能居开源第一梯队
上海人工智能实验室在2026浦江创新论坛发布开源基础大模型书生-S2,该模型科学能力比肩顶尖闭源模型,通用能力居开源第一梯队,创新架构支持专业知识持续扩展,强化长程科研与智能体能力,可为真实科研任务提供支撑。
十四年的「管家」局,科沃斯这回把应用定义权交了出来
2026年世界机器人大会上,科沃斯董事长钱东奇提出「未来应用,由用户定义」。回顾过去,从2012年推「亲宝」到2026年发布「八界」,其发展有迹可循。当前,科沃斯推出创新方案和开源生态欲破具身智能难题。
Claude两个新模型实测流出!空间推理封神,算力直接榨干了
Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。
模型换个Harness就「变笨」?EverMind把自进化从研究推向产品,让AI「越用越聪明」
同一模型换 Harness 表现或大幅波动,暴露自进化走向产品的两个关键问题。EverMind 用 HarnessBank、Raven 与 EverMe 解决,将自进化从研究推向产品,让 AI「越用越聪明」。
一个场景吃掉700MB显存!3DGS存储焦虑怎么解?这篇综述划了五个方向
过去三年,3D Gaussian Splatting(3DGS)成实时3D场景重建与新视角合成“默认答案”,但场景拓展后有显存、带宽和功耗限制。香港科大等联合发布综述,从底层数据流组织技术版图,给出优化建议和未来方向。
AI视觉创作总差点意思?中科大等综述500+篇文献,系统分析生成一致性
中国科学技术大学等多机构研究者发表综述,梳理超500篇论文,揭示扩散模型视觉内容合成“一致性危机”,介绍三类一致性关系、加强位置、评估问题,指出未来模型需具备冲突感知等能力。