良率提升」共找到 2935 篇相关文章

新闻资讯8

GPT-6 Astra突袭:正面对垒 Fable 5.1,多项编码测试反超!OpenAI 总裁:欢迎来到 AGI 时代

今天凌晨,OpenAI 发布 GPT-6 Astra,公司称是多年研究成果。它在多项测试表现出色,编程、电脑操作等能力提升,还加强了安全措施。将面向部分用户及通过 API 和 AWS 推出。

InfoQ
算法论文7

从 RLVR 到 RLSVR:开放式任务如何获得可核验奖励

COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。

深度学习自然语言处理
开源动态8

首个长程Doc2Repo训练集!代码Agent不止修bug,开始造仓库

中国人民大学高瓴人工智能学院发布DeNovoSWE数据集,专注长程软件工程任务。它通过特定机制构造高质量数据,为代码智能体长程能力训练提供支持,实验显示能显著提升模型仓库生成能力。

新智元
算法论文8

ICLR 2026 | Rebuttal 是一场「带着镣铐的舞蹈」?港科 RebuttalAgent 用心智理论「读懂」审稿人

香港科技大学研究团队提出 RebuttalAgent 框架,将心智理论引入学术 Rebuttal 任务。它通过 TSR 框架拆解任务,先‘读心’再‘落笔’,能生成有说服力回复,还可作为‘思维外挂’提升小模型表现。

机器之心
算法论文8

端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程

南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能体能力。

量子位
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
产品应用7

80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」

Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。

机器之心
新闻资讯8

AI的七窍打通了!谷歌发布Gemini Embedding 2原生多模态嵌入模型

谷歌发布Gemini Embedding 2新型基础架构,将文字、图像等数据整合到统一维度,终结旧工作流。该系统赋予机器五维感知,建立跨媒介沟通语言,提升运行效率,在多场景有应用潜力。

AIGC开放社区
7

Android Studio 新功能上线,Compose 预览可调,开发者:终于不用盯着屏幕傻调尺寸了

最新发布的 Android Studio Narwhal 3 Feature Drop 带来功能增强,有可调整大小的 Compose 预览、新备份恢复工具等。支持 AGENTS.md 文件定制 Gemini 行为,还有图片附件和 @File Context 特性,提升 AI 集成与协同能力。

InfoQ
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ