「GPU实现」共找到 2453 篇相关文章
Claude Skills,4000字详解 Anthropic 的思考
Anthropic推出新技能Claude Skills,作者认为它会引导第三方工具形态。Skills结合笔记式形态、可执行工具与AI调度自优化,具备低门槛、灵活表达等优势,还实现了AI自我进化,是一种新范式。
训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式
大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。
不止AlphaFold,「药界ChatGPT」横空出世!华人女投资人深度揭秘
AI初创Chai Discovery宣布分子设计模型Chai-2重构药物设计逻辑,将抗体设计成功率从0.1%提升到16%,实现零样本设计。其联创认为这是范式革命,未来药神或成提示词工程师。
马斯克Neuralink脑机接口新成果!看完头皮发麻
在Neuralink夏季更新报告会上,马斯克展示脑机接口N1最新成果,七名受试者分享其对生活的改变。Neuralink还公布未来三年计划,目标是2028年实现对大脑全面访问及脑机接口与AI整合。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
3个月手搓Gamma架构,这个团队打造出了场景白盒化推理的“下一代内容OS”
AI应用从生成范式转向任务执行范式,Pi团队3个月手搓Gamma架构,打造出场景白盒化推理的“下一代内容OS”。Pi将AI生成与人的编辑能力结合,解决传统创作难题,实现创作全流程系统内闭环。
不止动起来:SentiAvatar重新定义3D数字人动作生成范式
AI 初创公司 SentiPulse 联合团队提出 3D 数字人动作生成新范式 SentiAvatar,打造虚拟角色 SUSU,其框架等已全球同步开源。它解决了高质量数据荒等问题,实验表现优,还实现快速动作生成,支持流式交互。
杭州再出黑马,中国千亿市场被炸穿!AI「杀死」会计,达摩院大佬出手了
杭州精算家的「深蓝财鲸」炸穿国内千亿财税市场,实现90%降本。它具多智能体协作框架与动态策略进化引擎,冲击传统代账公司和中小企业财务岗,其团队来自达摩院,对标美国巨头Intuit。
再创历史!英伟达市值一夜突破5万亿美元,今年涨幅56%,黄仁勋晋升全球第八富豪
10月29日,英伟达市值突破5.03万亿美元,成全球首家破5万亿美元公司,今年涨幅56%。黄仁勋以1792亿美元持股价值居福布斯富豪榜第八。这或因GTC大会公布多项革新与合作,且AI热潮让其GPU需求旺盛。
vLLM 新特性:批量大小不再影响模型输出
vLLM 推出批量不变推理功能,解决大模型推理中相同输入在不同批量大小下结果不同的问题。设置 `VLLM_BATCH_INVARIANT=1` 可保证输出一致,技术实现含三部分,虽有性能开销但换来了结果确定性。