成本性能」共找到 6958 篇相关文章

算法论文8

均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事

当强化学习大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。

新智元
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智实验室等团队提出经验管理和学习框架ExGRPO,科学管理经验。与传统RLVR方法比,它在不同基准提升性,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
新闻资讯7

一手奶瓶一手键盘!新手宝妈产假氛围编程,自研实用家庭App

新加坡宝妈Laura Zaccaria产假自研家庭餐食规划App。她无编程背景,靠Cursor等工具学习。AI迭代快,她意识到要跟上,产假自我进化契机,提醒大家学习才不被时代抛下。

新智元
新闻资讯8

凯捷研究院最新报告:到2028年,Agentic AI市场规模4500亿美元

凯捷研究院报告显示,到2028年Agentic AI有望撬动4500亿美元经济价值,但目前仅2%企业规模化应用。其自主执行任务,带来商业价值,不过面临信任危机,各行业巨头已开始探索落地场景。

AIGC开放社区
算法论文7

只因一个“:”,大模型全军覆没

一篇论文发现冒号等符号、“Thought process:”等语句欺骗LLM,让虚假回答通过。实验表明所有测试模型都会触发假阳性响应。研究人员构建新“评委”模型Master - RM,可让假阳性率接近0%。

量子位
算法论文8

AI数学力暴涨100%,自进化直逼RL极限!CMU新作颠覆认知

数据枯竭AI发展瓶颈,CMU团队提出SRT方法,让LLM自我进化,提升数学与推理力,性逼近传统强化学习。研究还分析其局限,提出缓解奖励作弊策略及应对模型崩溃的方法。

新智元
算法论文8

ICML 2025 | 如何在合文本数据时避免模型崩溃?

随着生式AI发展,合数据大模型训练重要部分,但可引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
产品应用7

腾讯WorkBuddy联名硬件来了!首批100多家伙伴入场

9月2日腾讯WorkBuddy开放平台上线,亮相9款联名智硬件、30多个行业应用与超100家生态伙伴。其是国内AI Agent赛道首个打通三层生态的开放平台,目标是「面向Agent时代的操作系统」。

量子位
新闻资讯7

56亿颗芯片撑起230亿市值!北交所芯片第一股今日上市

8月12日杰理科技于北交所上市,“芯片设计第一股”。其以蓝牙音频为基本盘,产品进众多品牌供应链。2023 - 2025年营收有波动,业绩在2025年回落。募资投向三大项目,后续表现待察。

芯师爷
开源动态8

15小时3.5万Star!Altman投资的AI终端开源炸圈:曾经没人用,如今靠Agent翻身

AI编程赛道竞争激烈,Altman支持的现代终端Warp宣布开源,OpenAI创始赞助商。Warp团队认为传统开发模式遇瓶颈,开源可汇集创意,让人类开发者转型为“代理管理者”。此外,Warp在功上也有开放举措。

AI前线