自注意力层」共找到 1526 篇相关文章

新闻资讯7

Anthropic、OpenAI、谷歌和微软都认为智能代理控制是产品,但在定价上存在分歧

近期,Sycamore获6500万美元种子轮融资用于构建主企业级AI操作系统,Anthropic、OpenAI等也有动作。各实验室都认可智能代理控制是产品,但在定价和交付模式上分歧明显。

InfoQ
算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
产品应用8

突破企业AI落地的瓶颈:LangGraph × OceanBase 的融合数据深度实践与解析(附源码)

麻省理工报告显示约95%企业实施AI后未获商业回报。文章从企业级AI应用场景切入,探讨数据需求,通过Demo展示LangGraph与OceanBase融合构建数据底座,解决企业AI落地瓶颈,附源码。

AI大模型应用实践
开源动态8

长上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破

月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在多任务测试表现出色,还开源相关资源,推动高效长上下文模型研究。

AIGC开放社区
产品应用8

当AI开始重写己:EverMind的进化智能体框架Raven,正在定义数字生命的下一个形态

机器之心发布文章,介绍 EverMind 基于研记忆系统 EverOS 发布进化 Agent 框架 Raven。阐述其研发背景,指出传统 AI 无状态问题。还讲了 EverOS 特点、数字生命演进四阶段,以及 Raven 技术逻辑、对用户和开发者的价值等。

机器之心
开源动态8

首篇进化智能体系统技术报告出炉:Token成本直降近10倍,省钱又高效!

全球首个基于‘上下文信息密度最大化’的进化智能体系统GA发布技术报告。它在多基准测试表现惊艳,能省近10倍Token,还能我进化。报告深度解读设计理念,剖析进化能力与智能体设计思路。

机器之心
算法论文8

联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散回归生成方法重焕生机,轻松渲染长文本图像

图像生成领域,回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。

机器之心
产品应用8

Qwen-lmage-Layered:图片分 指哪改哪

全新图像生成模型Qwen-lmage-Layered采用研架构,将图片“拆解”成多个图,各图可独立操作。其提出新编辑思路,有RGBA - VAE等亮点,支持灵活迭代分解,能实现精准高效的图像编辑。

通义千问Qwen
新闻资讯7

DeepSeek被曝研AI推理芯片

据路透社报道,DeepSeek 正开发研 AI 推理芯片,欲降低对英伟达和国产芯片依赖。此为重大战略转变,影响英伟达股价。虽有降本等好处,但面临技术、制造、生态等挑战。

机器之心
算法论文7

The Batch:826 | 提高输出准确性的记忆

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI