「推理优化技术」共找到 5309 篇相关文章
全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型
中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。
智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%
开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。
老黄力推的 Physical AI,有人用开源框架打通了硬件的最后一道关
巨头加速布局Physical AI,全球AI云平台涂鸦智能用TuyaOpen开源框架破局,为开发者提供入场券。它可拆技术墙、通生态孤岛、跨商业化黑洞,还让开发者打造多样AI硬件,助力商业化。
Who’s Adam?最逆天的NeurIPS评审出炉了
这两天大家收到NeurIPS 2025评审结果,网上现逆天评审意见,把Adam优化器当成拼写错误。投稿量飙升致审稿质量难保证,AI评审成普遍现象,还推荐了写反驳意见的博客。
独白:OpenAI前员工的深度反思
OpenAI前员工在博客分享工作体验,从文化、技术等多维度剖析公司。指出极速扩张面临挑战,文化独特,技术上用Python单体代码库、依赖Azure,还详述Codex项目诞生,认为AGI竞赛在OpenAI等三家展开。
ACL 2025 | AI字幕慢半拍,不知道大家在笑什么?新方法让同传性能直逼离线翻译
香港中文大学、字节跳动Seed和斯坦福大学团队提出SeqPO - SiMT框架解决同声传译“质量 - 延迟”权衡问题。该方法将同传建模为序贯决策过程,优化决策序列,实验显示其性能直逼离线翻译。
苹果在WWDC提到的本地模型,这家公司把它提速了220倍
苹果在WWDC开放本地语言模型API,让iPhone等有了“AI大脑”,但开发者面临模型运行慢问题。国产团队面壁智能发布MiniCPM 4.0,端侧处理长文本提速惊人,从多层面创新实现,还补上推理框架缺口。
Linear-MoE:线性注意力遇上混合专家的开源实践
近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。
GPT-5.5 Instant上线:幻觉减少52.5%,告别废话
OpenAI完成ChatGPT默认模型的静默升级,GPT-5.5 Instant全面替换GPT-5.3 Instant。它在数学推理、减少幻觉、精简回答、记忆功能等方面有显著改进,还采用灰度推送策略。开发者认为其定位是日常场景够用顺手。
让AI接管我家:钢铁侠有的,我也能有
作者邓天卓分享用AI重建家庭数字生活的经历。从迁移20年数据,到让AI控制家电、汽车,还能排查电脑木马、整理照片等。虽AI有不足,但技术已能把科幻变成日常,家庭AI工作站可慢慢搭建。