长链执行」共找到 1426 篇相关文章

算法论文8

Transformer祖传设计遭暴击,COLM顶会三篇论文发难

COLM 2026上,三篇论文对Transformer关键技术发难。《Cracks in the Foundation》指出上下文架构选择影响大;《Lost in Backpropagation》揭示输出投影层信息损耗严重;《When Fewer Layers Break More Chains》表明层剪枝影响推理。

量子位
新闻资讯7

英特尔「亲爹」要买干儿子?CEO陈立武的双重身份藏不住了

英特尔考虑拿下SambaNova,现任CEO陈立武还是SambaNova执行董事。英特尔此前GPU发展滞后,此次是重新发力AI芯片赛道。SambaNova曾想融资,若被收购估值或缩水,其目标是挑战英伟达。

新智元
新闻资讯7

英伟达推理服务器被曝高危漏洞,云端AI模型被攻击直接裸奔

安全研究机构Wiz Research曝光英伟达Triton推理服务器一组高危漏洞,可组合利用实现远程代码执行,造成模型被盗、数据泄露等后果。英伟达已发布补丁,25.07版本前系统有风险。

量子位
推荐文章7

蚂蚁武威:下一代「推理」模型范式大猜想

文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为思维推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。

AI科技评论
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示思维SFT会带来安全性能退化。

AI科技评论
产品应用8

Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性与安全性全面升级

Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及交互推理能力增强,无害响应率提升,合作率下降,定价不变。

InfoQ
新闻资讯7

库克与苹果

苹果CEO库克宣布卸任,转任执行董事。他在苹果28年,任CEO 15年,让苹果市值和营收大幅增,打造强大供应,推出多新品类。但造车项目取消,Vision Pro未打开大众市场,AI发展滞后。接班人是硬件工程师John Ternus。

AGI Hunt
新闻资讯7

“十五五”时期中国芯片三个着力点

中国集成电路产业近十年‘自主可控’取得阶段性成果,但也面临风险挑战。‘十五五’时期,产业应推动供应从自主到全球融合赋能、创新从跟随到技术主权觉醒、产业从脱节到全协同共振。

芯师爷
算法论文8

轻量高效,即插即用:Video-RAG为视频理解带来新范式

现有视觉语言模型处理视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决视频理解问题,适用于多场景。

机器之心
开源动态8

上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破

月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在多任务测试表现出色,还开源相关资源,推动高效上下文模型研究。

AIGC开放社区