「模型突破」共找到 8231 篇相关文章

算法论文8

国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!

键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越长,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。

AINLPer
算法论文8

超越90%城市规划师!清华、MIT等提出人机协作新范式 | Nature子刊

清华大学联手MIT等机构提出「大语言模型+规划师」新框架,让AI作「智能规划助手」。框架含概念设计、方案生成、效果评估三阶段,实验显示AI表现超九成人类规划师,未来将人机协同。

新智元
新闻资讯7

The Batch: 876 | Gemini 的环境影响测算

谷歌研究人员对驱动 Gemini AI 助手的模型进行一年研究,发现处理一个提示的环境影响小。其能耗、水耗和温室气体排放量远低于此前估算,2024 - 2025 年处理中位提示时能耗、排放大幅降低。

DeeplearningAI
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心
新闻资讯7

英伟达推出通用深度研究系统,可接入任何LLM,支持个人定制

英伟达推出通用深度研究(UDR)系统,支持个人定制,可接入任何大语言模型。它能解决现有深度研究智能体的局限性,有诸多创新特性,但目前还在原型阶段,存在一定局限性。

量子位
新闻资讯8

资本视角下的智造落地战:五位投资人划定关键赛道与投资红线|甲子引力X

在「2025甲子引力X中国科技产业投资大会」上,五位投资人共议智能制造。他们认为当前制造业面临降本增效等挑战,投资时“团队”是关键,中国智能制造在多领域有成长空间,创业者要内修能力、外抓需求。

甲子光年
算法论文7

谷歌:Embedding检索存在根本理论局限,Sparse、Graph才是未来?

近年来稠密向量检索广泛应用,社区认为embedding能‘包打一切’,但谷歌DeepMind从理论与实验指出其存在根本局限。相关实验代码和数据已开源,还给出替代方案。

PaperAgent
算法论文8

仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?

这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。

深度学习自然语言处理
推荐文章7

LLM 商业化猜想:OpenAI 会走向 Google 的商业化之路吗?|AGIX PM Notes

文章探讨了大模型商业化难题,对比 OpenAI 潜在变现方案与 Google 商业模式,分析 OpenAI 开启类似 Google 商业化引擎的可能性,还给出 AI 搜索引擎可能的变现思路,并总结了本周市场情况及 AI 公司动态。

海外独角兽
产品应用7

藏师傅教你用 Nano Banana 编辑图片做手办

前几天发 Nano Banana 测评后,很多人不知怎么用。刚好做手办图玩法火了,作者教大家在 LM Arena 用 Nano Banana 编辑图片、做手办图,还介绍把图片变视频及剪辑的方法。

歸藏的AI工具箱