「技术与文化」共找到 8232 篇相关文章

算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
新闻资讯7

100亿H20没卖出,英伟达狂赚1000多亿破纪录!

今早英伟达公布2026财年第一季度财报,营收、净利润双双破纪录。虽因H20芯片问题流失80亿美元营收机会,但AI推理爆发、与马斯克合作及欧洲扩张成新增长点,预计下季营收450亿美元。

新智元
算法论文8

ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键

ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集中极大值,V表示无此模式。研究通过实验明确极大值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。

深度学习自然语言处理
新闻资讯7

对话赵天奇:从AI短剧到互动影游,聚力维度的“升维”之战

本文是对聚力维度创始人赵天奇的访谈。他认为 3D AI 技术潜力大,团队聚焦 AI 漫剧/短剧,用自研赛娲大模型降成本。还将拓展 3D 互动影游,认为它是游戏终极形态,从业者要回归影视本质,创业者需拥抱变化。

AI科技评论
新闻资讯7

承包了春晚的4家机器人企业,都什么来头?

今年春晚机器人表现亮眼,背后四家企业各有来头。银河通用王鹤专注具身多模态大模型;宇树科技王兴兴三次登上春晚,技术迭代快;松延动力姜哲源辍学创业,产品获订单;魔法原子吴长征有全栈自研能力,融资后欲冲击IPO。

芯师爷
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
推荐文章9

快去提问!沐神空降小红书,在线答疑

本文整理了深度学习大牛李沐(沐神)在小红书开展的AMA答疑内容,覆盖AI学习、职业方向、技术趋势、行业赛道等大众关心的热门问题,给出了直白干货的回答,适合AI从业者、学生参考。

机器之心
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai
算法论文8

2篇最新Anthropic论文,揭开LLM对齐新范式

Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。

PaperAgent
开源动态8

探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜

南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技