质量保证」共找到 688 篇相关文章

新闻资讯7

Anthropic承认模型降智后仍放任其偷懒?Claude Code用户信任崩塌中

此前大模型厂商未正面承认‘降智’,OpenAI 研究科学家称是心理错觉。但 Anthropic 公开承认旗下 Claude Opus 4.1 和 Opus 4 质量降级,然而问题未解决,Claude Code 用户信任崩塌,纷纷转向 GPT - 5。

机器之心
新闻资讯7

英伟达确认恢复 H20 在中国销售,并推出面向中国的全新 GPU

7月15日英伟达官网发文,将恢复H20在中国销售,黄仁勋称正提交重售申请,美政府保证发许可证。还推出面向中国的全新GPU,强调AI成基础资源,致力支持开源研究等。

InfoQ
新闻资讯7

AI“氛围编程”威胁开源,维护者面临危机

开源维护者正加速关闭外部贡献,因AI生成贡献量大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质量。平台激励加剧问题,虽有应对策略但效果不佳。

InfoQ
8

仅2G内存可跑,刚刚,谷歌开源Gemma 3n,端侧原生多模态!

谷歌全面发布Gemma 3n,将多模态AI功能带入边缘设备并在Hugging Face开源。它原生支持多模态输入输出,针对设备端优化,内存占用低,采用开创性架构,Gemma系列质量也不断突破。

PaperAgent
开源动态7

视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式

香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。

机器之心
算法论文7

从 RLVR 到 RLSVR:开放式任务如何获得可核验奖励

COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。

深度学习自然语言处理
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量

AI科技评论
算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量

量子位
开源动态7

Rx.NET 7.0 拆分 Windows UI 支持,大幅缩减应用部署体积

Rx.NET 7.0 发布,重点为缩小 Windows 应用部署体积。它将 WPF 等集成功能从核心包拆分,解决自包含应用框架依赖问题。虽有破坏性变更,但维护团队保证了一定兼容性。后续有新开发计划。

InfoQ
开源动态7

112个OpenClaw预建技能,让你的“龙虾”变成全职管家

开源项目 ClawFlows 为 OpenClaw agents 配备 112 个预建「技能包」,安装和启用简单,覆盖智能家居、日程管理等多领域。工作流以 markdown 文件呈现,支持多种语法,可修改分享,但有使用限制和质量差异。

AI工程化