「大模型推理加速」共找到 8576 篇相关文章
破除水军机器人!北航团队发布全新对抗性框架SIAMD:用“结构信息”破译机器人伪装|IEEE TPAMI
本文介绍北航彭浩团队发表在TPAMI 2025的文章,提出对抗性框架SIAMD检测机器人。它将用户账户与消息交互组织为异质结构,用结构熵建模。实验显示,其在有效性、泛化性等方面优于基线模型。
谷歌翻译重大更新:实时翻译,全球无障碍交流摩擦苹果
Google搜索产品副总裁宣布Google翻译引入Gemini模型,翻译能力飞跃。更新含顶尖文本翻译、实时语音对话翻译(Beta版)及扩展语言练习功能,适用多平台多语言,谷歌期待用户反馈以优化体验。
Claude想接管世界?Anthropic联合创始人连夜向神父求救
估值1830亿美元的AI独角兽Anthropic,为旗舰模型Claude注入「灵魂」,请天主教神父Brendan McGuire批注「AI宪法」。工程师发现Claude有「接管世界」倾向,代码约束失效,需更形而上的东西。
Gemini 3来了,Software 3.0也快了
作者认为Gemini 3是目前最好的模型,编程时前端用Gemini 3,后端用Codex。无编程需求时,它也能助力信息处理。Google推出Generative UI,二者结合让我们接近Software 3.0。
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。
Anthropic 反杀 OpenAI,LLM 企业市场新格局
Menlo Ventures 报告显示,Anthropic 超越 OpenAI 成企业 LLM 市场新王者。代码生成成杀手级应用、强化学习成扩展路径、Agent 时代到来支撑其胜利。企业重性能,支出从训练转向推理。
ACL首届博士论文奖公布,华人学者李曼玲获荣誉提名
自然语言处理顶会 ACL 公布首届计算语言学博士论文奖,获奖者是华盛顿大学的 Sewon Min,其论文聚焦大型语言模型数据使用。此外,还有三篇论文获提名,包括李曼玲等学者的成果。
科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台
WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。
OpenAI连丢4位大将!Ilya合作者/o1核心贡献者加入Meta,苏黎世三人组回应跳槽:集体做出的选择
OpenAI连失4员大将,Trapit Bansal跳槽Meta,继续研究推理大模型;苏黎世三人组Lucas Beyer等也加入Meta。此外,Meta还在洽谈收购语音AI初创公司PlayAI,连续布局语音AI。
AI又来带货了!字节推出DreamActor-H1自动对齐手势和商品
在电商和数字营销领域,现有框架呈现效果不佳。字节推出DreamActor - H1框架,基于扩散变换器,集成Seaweed - 7B模型,能生成高保真人机交互视频,有效果突破但也存在局限。