长任务时代」共找到 3508 篇相关文章

算法论文8

32k微调处理百万Token:21倍的推理加速,10倍的峰值显存节省,实现恒定内存消耗

现有大模型处理超文档易内存爆炸、计算崩溃。阿里巴巴未来生活实验室推出CoMeT架构,有双轨并行记忆系统,能恒定内存、线性时间处理文本,在基准测试超主流方法,实现21倍推理加速和10倍显存节省。

量子位
开源动态8

MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一

MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。

AI工程化
算法论文7

姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”

姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。

量子位
产品应用7

谷歌用一堆不赚钱的AI小玩意,给科技圈上了一课

谷歌Arts & Culture网站有不少艺术实验项目,从商业看无直接价值,但藏着人文坚守。如Botanic Atlas、Art Palette等,用技术拓展感知文化方式,消解艺术与大众的隔阂。

机器之心
开源动态8

Google 把翻译能力彻底开源了!TranslateGemma:550种语言通吃,还能直接看图翻译!

Google将多年积累的翻译能力灌进开源大模型TranslateGemma,它基于Gemma 3,专为翻译任务调优,有3个规模版本,覆盖550种语言,能直接看图翻译,亮点颇多。

开源星探
算法论文8

智能体「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了

在LLM/VLM驱动的智能体强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能体成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。

量子位
新闻资讯8

英特尔CES奇袭老黄大本营!英伟达显卡刚涨价,最强酷睿量产出货

英特尔第三代酷睿Ultra处理器正式开卖,基于Intel 18A制程,有RibbonFET和PowerVia两大黑科技。移动端有酷睿Ultra X9和X7,图形处理、多线程性能提升,续航达27小时,边缘处理器与PC同步发布。

量子位
开源动态8

告别AI胡说八道,Meta新方法CoVe准确率飙升 28%

大模型‘幻觉’问题一直是‘严肃使用场景’的难题。Meta AI团队提出CoVe新方法,让大模型学会‘自我反省’。该方法通过四步走实现自我纠错,能大幅降低幻觉率,还具备三大优势。

CourseAI
新闻资讯7

AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效率,Token成本失控后上下文工程成胜负手

本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。

InfoQ
新闻资讯7

腾讯胡文博:引领 3D 视频世界模型新趋势丨GAIR 2025

2025年12月12 - 13日,第八届GAIR全球人工智能与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界模型》论坛分享《迈向三维感知的视频世界模型》。他深耕视频生成模型,成果显著。

AI科技评论