中数睿智」共找到 2931 篇相关文章

8

两年半后,我不再“写”代码,而是“指挥”一个AI团队

腾讯程序员分享两年半使用AI的经验,涵盖工作与生活。工作,介绍信息处理、规划、执行、复盘等流程的AI工具及用法;生活里,提及AI在育儿、娱乐等场景的应用,鼓励开放心态尝试。

腾讯技术工程
算法论文8

给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理

如今大模型长上下文推理面临计算成本高、推理易断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验表现优异。

量子位
算法论文8

ICML 2025|如何凭「自动补全」实现100K生成3×加速?

在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验表现亮眼。

机器之心
新闻资讯8

陶哲轩ICM 2026:学界迎来「百年新危机」,AI狂飙逼迫全行业重写游戏规则

7月24日,陶哲轩在ICM 2026演讲指出学界正经历新危机,关乎价值观与工作方式。他围绕AI能力猜想探讨学界如何应对,列举目标和风险,提出需升级目标,还介绍莱顿宣言建议。

AI寒武纪
算法论文8

信通院&清华提出FedRE:用「纠缠」搞定联邦学习三难困境 | CVPR 26

联邦学习兼顾模型性能、据隐私和通信开销是挑战,尤其在模型异构场景。信通院和清华联合团队提出FedRE框架,能适配异构与同构场景,保证性能同时保护隐私、降低开销。

量子位
算法论文8

ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练

在检索增强生成系统,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。

机器之心
算法论文7

LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!

文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。

AINLPer
开源动态8

全景视觉的Depth Anything来了!Insta360推出DAP,200万据打造全场景360°空间智能新高度

Insta360等团队推出全景度量深度基础模型DAP,构建200万量级全景据引擎,设计三阶段伪标签管线,在模型架构上也有创新,在多项测试效果优异,项目代码与模型已开源。

机器之心
算法论文7

Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏

Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。

机器之心
8

打脸OpenAI!谷歌Gemini高级版获IMO 2025官方认证金牌:纯自然语言端到端推理

谷歌DeepMind宣布高级版Gemini在2025年IMO6题解5题获金牌,经官方认证,全程用自然语言推理。对比OpenAI自我宣称拿金牌,谷歌成绩更有说服力,还介绍了Gemini进步及实现方法。

AI寒武纪