「全注意力模型」共找到 8738 篇相关文章
用DAA衡量智能体 百度智能云用“新全栈”重新定义AI云|甲子光年
2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新全栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。
阿里安全AGI一次发布3款LLM,8B多维度领先GPT-5.4
近期,阿里安全AGI实验室发布3款Yuvion LLM,在AI安全与内容安全领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
【一手实测】字节豆包 1.6 + Trae + 火山 MCP + FaaS:AI Agent 开发部署全流程体验!
本文作者实测字节豆包1.6系列模型,用其设计落地页,还借助Trae、火山方舟MCP等实现AI Agent开发部署全流程。测评显示豆包1.6多模态能力强,处理复杂指令效果好,价格实惠,字节AI云原生生态前景佳。
北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图
北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。
5000万用户、5000万美金ARR,全球第一AI创作消费平台要做AI时代Roblox
在AI大模型军备竞赛中,用户侧出现‘智能过剩’。SeaArt成立两年半成全球访问量第一的AI内容创作社区,其2.0版本SeaVerse实现全流程自动化。该公司不陷‘卖模型’陷阱,商业模式独特,有望成AI时代全民级内容平台。
一场文心大模型的「AI马拉松」
2025 年模型能力至关重要,百度在基础模型研发持续投入。百度 AI Day 上,吴甜解读文心新模型技术,文心 X1 Turbo 推理强、成本低。百度技术体系完备,未来看好多模态与智能体,降成本促应用生态发展。
最高能效比!他又死磕“存算一体”2年,拿出全新端边大模型AI芯片
后摩智能CEO吴强在今年WAIC期间发布业界能效比最高的存算一体端边大模型AI芯片后摩漫界®M50。它搭载第二代存算一体技术,全栈自研实现软硬件协同优化,还配套系列产品,构建端边智能新生态。
视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26
清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。
腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合
日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。