「R1论文」共找到 2684 篇相关文章
AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出
在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定后不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。
英伟达新“桌面超算”800GB大内存,满血DeepSeek R1能装1个半
英伟达在Computex大会宣布新办公室落户中国台湾省台北市,还推出多款新品。如面向个人的DGX Station有800GB内存,能跑大模型;面向企业的RTX PRO Server可加速多种用例。此外,还发布新平台、宣布合作等。
大模型推理上限再突破:「自适应难易度蒸馏」超越R1蒸馏,长CoT语料质量飞升
本文从中兴通讯无线研究院「大模型深潜」团队切入,介绍了首创的「LLM自适应题目难度蒸馏」方法,该方法围绕「模型 - 数据动态匹配」提出了一条完整的CoT构建流程,显著提升了长CoT语料的质量。
微调已死?Google 和斯坦福论文指出AI 学习新范式
Google的ReasoningBank和斯坦福的ACE两篇新论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
Cursor 1.0 正式发布:AI 代码编辑器进入“自动审查 + 记忆”时代!
智能代码编辑器 Cursor 正式发布 1.0 版本,带来多项重磅功能,如自动代码审查助手 BugBot、Jupyter Notebook 原生支持、项目级 AI 记忆等,还提升了用户体验,是向“AI 编程操作系统”迈进的重要一步。
V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!
DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。
Qwen负责人转发2025宝藏论文,年底重读「视觉领域GPT时刻」
2025年末,Qwen大模型技术负责人林俊旸转发谷歌DeepMind入选ICCV 2025的论文,指出视觉领域“GPT时刻”要来了。研究用实验数据证明,视频模型正跳出任务专属局限,实现一个模型完成多视觉任务,推理过程还能被CoF“演”出来。
清华&Qwen最新论文实证: VLM 智商与机器人操控能力“零相关”
清华和 Qwen 最新论文《VLM4VLA: Revisiting Vision - Language Models in Vision - Language - Action Models》测试 24 个 VLM 模型,构建极简 VLM4VLA 测试,发现 VLM 通用能力与机器人操控能力‘零相关’,还揭示视觉编码器短板。
OpenAI诈骗?GPT-4.1正式上线ChatGPT,网友实测却大呼失望
OpenAI官宣GPT - 4.1在ChatGPT中可用,Plus、Pro和Team用户可访问。它擅长编码和遵循指令,评估表现有优有劣。实测代码处理表现佳,但网友因无100万上下文窗口API版本而失望。