「端到端加速」共找到 2809 篇相关文章
AI半壁江山是中国人!黄仁勋敲警钟:美国再不觉醒就晚了
在华盛顿的Hill&Valley论坛上,黄仁勋指出全球50%的人工智能研究人员来自中国,呼吁美国加速布局AI。他还介绍了英伟达的相关计划,提出维持美国AI领导力的建议,强调了人才、资本与生态在算力革命中的重要性。
Pipeline MinerU真快不行了
文章聚焦Infinity-Parser,指出它把OCR从‘做识别’推进到‘做结构’。它采用layoutRL强化学习框架,结合真实与合成数据构建Infinity-Doc。跑分强且复杂结构表现优,透露Document AI向结构化生成转变趋势。
理解与生成统一多模态模型:现状与未来 | 直播预约
从GPT - 4o到Gemini,AI实现跨模态联合理解与生成,核心是统一多模态基础模型。但开源社区构建强大统一模型面临挑战。南大等团队梳理超750篇论文分析技术路线,将有直播探讨现状与未来。
vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025
在AI多模态时代,‘让大模型上手机’成焦点。现有MLLM在手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,在骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。
The Btch:838 | 苹果加强生成式 AI 布局
苹果更新 Apple Foundation Models(AFM)系列,含设备端和服务器端版本,还发布 Foundation Models 框架。AFM 模型架构特别,训练有优化,测试表现有差异。此前苹果论文引争议,此次或是其重启 AI 战略之举。
刚刚,全球第一CRM收购AI Agent平台Moonhub
今日凌晨,全球第一CRM平台Salesforce收购AI Agent平台Moonhub,Moonhub团队将加入开发Agentforce。此前Salesforce已收购Informatica,其CEO看好AI Agent,愿景是到2025年底开发十亿个智能体。双方在HR智能体功能各有亮点。
阶跃开源JetSpec,大模型推测解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。
亲手造出砸自己饭碗的怪兽!Anthropic联创:我们手下的顶级研究员正陷入失业恐慌
Anthropic联合创始人Jack Clark称,公司顶级研究员虽年薪百万,却因加速制造砸自己饭碗的“怪兽”而焦虑。大模型或使社会财富飙升但大量人失业,预计2028年底人类将从AI迭代链条“下岗”。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。
「上下文学习」之后,腾讯混元第二篇公开研究:精准定位RLVR训练崩溃的“罪魁祸首”Token
腾讯混元团队新研究提出异常梯度定位器 GradLoc,可将全局梯度突刺定位到具体异常 token,降低 RLVR 训练观测与分析门槛,助力解决训练不稳定问题,让模型调优更科学。