稳定性提升」共找到 3010 篇相关文章

新闻资讯7

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

Anthropic发布Claude Sonnet 5,称其为最具Agent属性的Sonnet模型。它在推理等方面性能提升,接近Opus 4.8且价格低。安全评估有改善,但网络安全逊于Opus 4.8。已正式可用,有优惠首发价。

机器之心
算法论文8

ACL 2026|打破推理同质化!阿里达摩院新作让RLVR从重复采样走向有效探索

阿里达摩院智能决策团队提出面向RLVR后训练的探索增强框架I²B-LPO,改进rollout策略,在关键节点生成更具区分度的推理轨迹,结合信息瓶颈自奖励机制,在多个数学基准上提升准确率与语义多样性。

机器之心
新闻资讯7

加速突围!9款信号链芯片背后的“芯”趋势

在高端ADC/DAC领域曾被国际巨头长期垄断。2025年‘芯师爷 - 硬核芯年度评选活动’展示多款信号链芯片。国产芯片发展有高端突破、汽车电子爆发、全产业链延伸三条路径,但也面临参数提升、高端场景拓展及海外竞争挑战。

芯师爷
算法论文8

10行代码,AIME24/25提高15%!揭秘大模型强化学习熵机制

来自多机构的研究者揭示大模型强化学习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给大模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。

新智元
产品应用8

1000+页PDF解析速度暴涨3倍,MinerU模式不香了

百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。

CourseAI
新闻资讯7

Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱

据报道,Meta 公司内网出现 AI token 消费排行榜,追踪超 8.5 万员工 token 使用情况,过去 30 天消耗超 60 万亿 token。这反映“Token 最大化”文化,引发 token 消耗是否等同于生产力的争议。当前 Agent 系统高 token 消耗是补偿机制,应提升使用效率。

AI前线
算法论文8

画数独、烧蜡烛都不翻车了?浙大&阿里让AI先三思再下笔|ACL 2026

当下视觉生成中,开源模型在逻辑推理生成任务上频频翻车,与闭源模型有差距。浙大与阿里团队提出Unified Thinker,将思考与执行解耦,构建数据集、采用创新算法,实验显示其有效提升逻辑执行准确度。

量子位
推荐文章7

告别“氛围编程”:基于 Harness 治理和 SDD 的团队级 AI 研发范式演进与实践

本文作者王树新分享团队级AI研发范式演进与实践。指出AI Coding存在自由发挥、效率降低、关键信息丢失问题,分析出码率提升却未提效的原因,引入SDD与Harness解决问题,并介绍全流程自动化实践。

阿里云开发者
新闻资讯7

Claude灾难级大宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷

4月6日Claude新功能Ultraplan上线就遭遇大规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗大,Anthropic太急,产品稳定性堪忧。

新智元