全模态推理」共找到 3724 篇相关文章

开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π对收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且面拥抱开源。

量子位
算法论文8

ACL 2026 | 赋予视频生成「视觉思维链」:VChain显式建模时空规划与状态演变

南洋理工大学团队在ACL 2026发表VChain框架,引入大模型视觉推理能力提升视频逻辑连贯性。它分三步实现,实验效果超现有方法,还展示视频推理与生成的潜在趋势,为多模态模型协作提供范例。

机器之心
产品应用7

IDE?字节TRAE搞了个大升级,现在能流程开发了

国内首个原生AI IDE TRAE推出SOLO正式版,升级为集成多智能体协同架构与流程开发工具链的AI协作平台。新增SOLO Coder智能体,三栏布局更高效,升级思路贴合开发者需求。

量子位
开源动态8

不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天

谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。

AI寒武纪
产品应用8

行业的「龙虾热」中,什么是AI Infra下半场的「神之一手」?

OpenClaw爆火,标志AI进入「自主执行时代」,但面临安、资源利用和并发规模等挑战。腾讯云Agent Runtime为企业级AI智能体打造专业支持,解决状态管理和行为治理难题,还助力MiniMax突破性能瓶颈。

机器之心
新闻资讯7

刚刚,DeepSeek最新发文!V3/R1训练细节公开,信息量巨大

网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。

新智元
产品应用8

美团之后,京东也开始自研大模型了

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
算法论文8

斯坦福7B智能体面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
开源动态7

最强DeepResearch!通义DeepResearch-30B开源实战:模型部署+LangGraph+A2A攻略

阿里发布开源项目通义DeepResearch,在研究任务评测中表现出色,底层是30B的MoE专用推理模型,资源需求低。文章演示了基于该项目构建本地化端到端DeepResearch助理的方法,包括模型部署、Agent实现等。

AI大模型应用实践
新闻资讯8

313页的StateofAI2025报告解读:今年AI圈发生了什么

本文解读了313页的《State of AI 2025》报告,回顾去年预测,盘点今年AI圈大事,如DeepSeek崛起、OpenAI开源、NVIDIA循环投资等,还提及AI安、数据使用情况,最后给出2026年10个预测并为普通人提供关注建议。

花叔