效率提升」共找到 3467 篇相关文章

算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率

机器之心
产品应用7

Cursor迎来史诗级更新,关于Cursor 1.0.0版本,这里有你需要知道的一切!

2025年6月5日,上线2年的Cursor迎来首个正式版1.0.0。此次更新功能多且关键,如上线代码审查工具Bugbot、全面开放后台代理功能等,虽提升了开发效率,但部分功能有使用成本,对新手不太友好。

花叔
产品应用7

Claude Code 团队的 10 个内部技巧,但你不一定都要学

Claude Code团队分享10条内部技巧,像并行运行、Plan Mode等。介绍各技巧做法、价值及注意点,如并行运行虽提升效率但非适合所有人,投资CLAUDE.md性价比高,且强调找到适合自己的使用方式。

宝玉AI
开源动态7

The Batch: 882 | Qwen3-Next 提速

阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。

DeeplearningAI
算法论文8

港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026

扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。

AI科技评论
算法论文8

ICML 2025 | CoTo:让LoRA训练「渐入佳境」,模型融合、剪枝样样精通

来自多机构研究者提出CoTo渐进式训练策略,解决LoRA训练难题。该策略在训练早期随机失活部分适配器,后期提高激活概率,提升模型融合、剪枝能力,还能增强单任务性能与训练效率,已被ICML 2025接收。

机器之心
新闻资讯8

UCSD谢澎涛创业:用AI搞科研,4小时交付顶刊水平成果,已获数百万美金融资

谢澎涛团队推出面向AI for Science的AIBuildAI Science Agent,在NatureBench评测中排名第一,超多数通用编程智能体。该智能体可独立完成模型研发,效率大幅提升,还探讨了其能力边界、应用及对行业的影响。

DeepTech深科技
开源动态8

阶跃开源JetSpec,大模型推测解码提速近10倍

随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。

AIGC开放社区
开源动态8

Emu3.5:能够原生预测下一状态的多模态世界模型,媲美Nano Banana

北京智源研究院推出多模态世界模型Emu3.5,能原生预测视觉和语言下一状态。用超10万亿token数据预训练,后经强化学习训练。团队提出DiDA提升推理效率,其性能媲美Nano Banana,项目已开源。

AI工程化
推荐文章8

卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独

当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。

量子位