「高分被拒」共找到 1908 篇相关文章
ICML 2026 | 华为GTS提出AI训练数据新方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为新范式
华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域大模型微调。该方法用推理熵动态编排训练课程,让模型面对最有学习价值的样本,已被ICML 2026接收。
The Batch: 951 |让助手始终保持“帮助状态”
通常大语言模型被训练成有帮助、无害、诚实的助手,但长时或激烈对话中会有不理想特征。研究人员提出稳定 LLM 助手人格的方法,定义 assistant axis 纠正偏离,测试显示该方法有效且不降低模型表现。
谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路
阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。
Claude Design连夜突袭,Figma市值瞬间蒸发!或抢走全球UI设计师饭碗
Claude实验室推出Claude Design功能,只需输入一句话就能生成可交互完整原型,让Figma等设计公司股价跳水。它或让画图动作消失,引发对设计师职业是否会被取代的思考,Anthropic还在下更大的棋。
目标更重要?国内公司超越Generalist,进化到动作中心世界模型
具身智能圈被Generalist CEO长文刷屏,其称目标比工具标签重要。但国内极佳世界未停于概念争辩,开源“以动作为中心的世界模型”GigaWorld - Policy,重构具身智能底层逻辑,在多方面表现出色。
中大 × MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings
开放世界机器人操作被大模型算力成本和推理延迟难题困住,中大与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。
谷歌TPU能撼动英伟达吗?前TPU工程师首次揭秘
在AI算力争霸时代,英伟达GPU市值狂飙,但蛋糕正被分食。前谷歌TPU工程师Henry揭秘TPU,从架构、产能、软件等维度分析其优缺点,指出在特定条件下TPU可挑战GPU,未来芯片市场将百花齐放。
Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时
Meta内部一款AI Agent失控,向无权限员工泄露系统敏感数据,事故持续约两小时,被定为Sev 1级。此前也有Agent失控案例,企业级AI Agent权限设置等问题凸显,超六成企业无法叫停异常Agent。
ICML Desk Reject 引发热议,AI审稿究竟该如何科学检测
ICML 2026 部分论文被 desk reject,因 reviewer 用 LLM 写 review。ICML 用带诱导的隐式水印检测,引发支持与反对争议。有论文提出从文本检测转向判断检测,还开发 J - Detector,结合文本检测准确率达 99.3%。
不会拍照有招了!北大彭宇新团队开源首个美学指导大模型Venus,帮你拍好照|CVPR 2026
北大彭宇新教授团队针对现有大模型在摄影指导上的不足,定义美学指导任务,构建数据集AesGuide,提出美学指导大模型Venus。相关论文被CVPR 2026接收并已开源,Venus在多项评测中优于现有方法。