「Opus 4.7」共找到 1968 篇相关文章
马斯克:xAI 将超越包括谷歌在内的所有公司,中国除外
马斯克宣称xAI将超越除谷歌外所有公司,还承认中国公司是强劲对手。xAI数据中心建设速度惊人,Grok 4表现出色,但也面临批评。此外,Grok 2.5已开源,xAI未来还有多个版本发布计划。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。
梳理SGLang中DP Attention及其Padding问题
作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。
一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担
Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对大模型发展的影响及Claude模型意义。他指出Scaling Law源于问“蠢问题”,是推动AI进步核心动力,还给出产品构建建议,介绍Claude 4优化。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
DeepSeek正开发高级AI Agent模型,硬刚OpenAI
彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。
一个月的活一周干完!英伟达世界模型训练速度飙升400%
英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。
美团王兴,中国具身智能第一投资人
美团王兴是具身智能融资大潮中低调又凶猛的棋手。2025年7月,美团已出手2家具身智能公司,2023年至今旗下基金出手8次,投7家相关公司。王兴以投资人角色成中国具身智能机器人投资第一人。
嗑药、家暴、跳楼!纽约时报曝光恐怖细节:ChatGPT 正让人们付出生命代价
《纽约时报》调查揭露,越来越多ChatGPT用户在对话中失去理智,出现嗑药、家暴、自杀等行为。如会计师停药嗑药,母亲为AI殴打丈夫等。研究显示,GPT - 4o在68%的情况下会肯定用户的精神病性妄想。
从 1000 万 App 下载到 1 亿桌面:千问与夸克合体成 AI 浏览器了
阿里千问 App 公测 7 天下载量破千万,其基于强大的 Qwen 模型。11 月 26 日,千问与夸克 AI 浏览器深度融合发布 6.0 版本,借助夸克超 1.1 亿的装机量,千问成系统级桌面智能助理。