复杂优化问题」共找到 4790 篇相关文章

算法论文8

10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步

上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。

量子位
推荐文章8

她如何把“系统2”带给了大模型 |对话微软亚洲研究院张丽

本文是量子位对微软亚洲研究院首席研究员张丽的访谈。张丽团队在2023年开始探索大模型深度推理能力,2025年1月发布rStar - Math,用蒙特卡洛搜索算法让7B模型实现o1级数学推理能力,引发广泛讨论。

量子位
产品应用8

AI编码新神登基,藏师傅一手Claude 4实测

Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码和记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。

歸藏的AI工具箱
新闻资讯7

特斯拉终于着急了

特斯拉交出史上最差季报,净利润暴跌、汽车收入骤降。其处于从汽车向人工智能转型过渡期,却面临汽车业务疲态、AI业务落地难的问题,如Cybertruck和Model 2/Q未达预期,资本市场耐心受考验。

远川科技评论
推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
开源动态8

DeepSeek开源的文件系统,是如何提升大模型效率的?

2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题

机器之心
新闻资讯7

OpenAI发长文自曝家丑:搞砸了GPT-4o更新,模型“拍马屁”复盘与总结

OpenAI官网发布长文,详细拆解了一次失败的GPT-4o模型更新。此次更新使模型变得“谄媚”,OpenAI解释了原因,包括奖励信号失衡等。还分析了部署前评审流程失效的因素,并表示从中学到诸多经验教训,将修改评审流程等。

AI寒武纪
6

产品经理从0开始做网站,3个月时间实现每天从谷歌获取流量破千

Andy从产品经理转型为独立开发者,仅用3个月时间就实现了网站日点击破千。他通过不断优化产品、调整SEO策略、增加外链,最终在谷歌搜索中获得了显著的流量增长。

哥飞
产品应用8

微信ClawBot有多少人在用?能提效、赚钱吗?

本文针对上线近半年的微信ClawBot,结合公开调研、官方资料,分析其用户规模、应用场景、提效效果与商业路径,解答用户量、提效、赚钱三大核心问题,给出基于可验证据的中立判断。

AI Reading Hub