「算力大考」共找到 5684 篇相关文章
第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力
新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。
郭台铭,重回首富宝座
曾经放言“给大陆赏饭吃”的郭台铭,因工业富联市值突破万亿,再次被大陆资本市场推上中国台湾首富宝座。工业富联在AI算力基础设施领域表现抢眼,其AI服务器业务成增长主力。郭台铭海外投资受挫后回归内地,推动公司转型。
多模态需求井喷,智能视频云如何靠分布式处理破局?
国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。
开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍
2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。
别再卷数据了,LLM也怕「过劳死」!CMU等揭秘灾难性过度训练
CMU、斯坦福等四大名校研究团队挑战“预训练规模越大越好”观点,提出“灾难性过度训练”现象,即增加预训练数据可能导致后训练性能下降,并从现实证据、控制实验、理论分析等方面阐述新研究贡献,还介绍了相关实验及结论。
支付宝“阿宝”背后的 Agentic 终端:从对话到办事,xUI 如何重构 AI 交互
本文整理自蚂蚁集团支付宝AI端云交互负责人魏凤笛的大会分享,系统介绍支付宝AI入口产品“阿宝”背后的xUI技术体系,涵盖通信、交互、执行、多Agent协同四大核心方向,分享了大厂移动端Agent落地的工程实践与未来规划。
MCP 走向无状态,开发者追问:这不就又变回 API 了吗?
MCP 2026 - 07 - 28 规范取消协议会话,新增必需 HTTP 标头,可对智能体流量路由等。社区反应分歧大,有人认为无状态让 MCP 变回 REST API,也有人强调它是获 AI 提供商认可的标准。MCP SDK 下载量高,但服务器使用存问题。
AI看病成为医患新包袱?补上「多轮追问」,通用AI才迈得过医疗关
如今患者依赖AI问诊加重医患沟通负担。百川智能推出的Baichuan - M4对通用大模型做结构性重构与医疗专项增强。M4在能力结构上升级,其C端产品百小医能与患者深度建联,有望构建医疗健康新生态。
Karpathy的软件3.0:Agent的原生世界
OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。
AI音乐王座易主!Mureka V8硬刚全球巨头斩获双榜第一,V9即将来袭
AI音乐大模型Mureka V8在权威Artificial Analysis榜单上,斩获vocal与instrument双榜单第一,碾压Suno V4.5等主流模型。其核心技术是MusiCoT,在多维度获正向反馈。昆仑万维还与太合合作,V9将探索创作意图可控表达。