非推理任务」共找到 4104 篇相关文章

开源动态8

开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4

上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。

量子位
开源动态8

The Batch: 873 | 通过自监督学习实现更好得图像处理

Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。

DeeplearningAI
新闻资讯7

热议!DeepSeek V3.1惊现神秘「极」字Bug,模型故障了?

DeepSeek 最新的 V3.1 模型上线不到一周,因离奇 Bug 引发社区热议。无论执行何种任务,模型总会在文本中插入「极」字,自我修复时也无法避免,还存在多语言混用问题,网友猜测原因多为「数据污染」。

机器之心
算法论文8

传统RAG只会翻书不会用?RAG+让Reasoning能力上一个新高度!

现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性新增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。

深度学习自然语言处理
推荐文章7

对话 Lucius 赵赫:AI 员工的本质,是一份有 SLA 的劳动合同

这是对Lucius创始人赵赫的访谈。他表示Lucius做的是企业的Context Layer,提供有SLA的AI员工服务。目前服务三十余家企业,交付结果而提效,还探讨了AI员工角色、与人类关系、技术架构等内容。

Founder Park
开源动态8

让AI打游戏!能玩1000多款游戏,英伟达用4万小时视频训练出通用基础模型NitroGen

NVIDIA发布NitroGen模型,利用40000小时带按键显示的游戏视频,构建视觉-动作数据集,训练出能玩超1000款游戏的通用基础模型,在跨游戏泛化和微调任务中表现卓越,为具身智能发展提供新思路。

AIGC开放社区
新闻资讯7

Codex 积分制计费上线,Claude Code 急了……

OpenAI Developers宣布Codex推出积分制度,重置速率限制,ChatGPT Plus和Pro用户可买积分获额外使用量,每1000积分40美元。云端任务将计入速率限制,社区反应不一,且积分会过期,Claude Code为挽回用户送会员。

AGI Hunt
产品应用8

AI如何重塑大厂成熟业务?百度文库GenFlow打了个样

文章讲述百度文库借助AI从“资源下载站”变为“智能生产力平台”。其转型体现在产品定位重构、挖掘用户需求、跨业务协同。GenFlow2.0打通文库与网盘,提升体验、重塑边界,证明核心业务也能价值重生。

乱翻书
算法论文8

炸裂提速30倍!Meta提出REFRAF,无需改动模型,让RAG告别冗余与等待

近年来,RAG任务在提升模型回答质量的同时带来性能代价,Meta等团队合作提出REFRAG框架。它将无关段落压缩,引入强化学习选关键段落,实现高达30.85倍的TTFT加速,且无需改模型结构,实用性强。

深度学习自然语言处理
算法论文8

破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o

腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。

机器之心