「多GPU性能」共找到 5724 篇相关文章
Anthropic 那个“强到不敢发”的模型,终于来了!
今天凌晨,Anthropic 发布新模型 Claude Mythos Preview,它曾被指‘强到不敢发’。该模型能力跃升,尤其网络攻防能力突出,但因具‘双重用途’仅向少数伙伴开放,用于防御性网络安全项目。
第 2 章 主流 Agent 模式深度解析
文章深度解析主流 Agent 模式,用生活化类比介绍了 ReAct、Plan - and - Execute、Tool Use、Reflection / Self - Critique 四种模式,阐述其技术要点、优缺点及适用场景,还对多模式进行对比。
微软OEL框架:大模型一次部署,终身进化
微软最新论文Online Experiential Learning (OEL)提出让LLM在真实部署后持续自我进化的框架,无需人工标注等。介绍了在线体验学习的必要性、OEL方法论及实验验证,揭示关键洞察与启示。
AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用
GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。
深入理解OpenClaw技术架构与实现原理(下)
文章为《深入理解OpenClaw技术架构与实现原理(下)》,讲解各系统模块,如SandBox沙箱系统、记忆管理等,还介绍自进化、工作区与路由等机制,最后展望企业级智能体架构和应用方向演进。
这次,Agentic AI工程化的底牌全被抖出来了 | QCon北京2026
QCon全球软件开发大会·2026北京站4月举办,以‘Agentic AI时代的软件工程重塑’为主题。大会有主题演讲、专题演讲,汇聚一线专家探讨AI工程化等多方面内容,还关注AI向物理世界延伸,讲师分享实践经验。
VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%
至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力。
开源音视频同步SOTA基座:极简的单流架构,2秒出片
AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。
终于,清华团队养出一只能「断网干活龙虾」!两栖版智能体杀疯了
国内「龙虾」市场分化为「云端API派」和「本地模型派」,用户面临成本与安全难题。面壁智能发布EdgeClaw Box,联合开源EdgeClaw框架,以「端云两栖」破局,在多场景展现优势。
每周产业洞察 | 中制协“开年第一会”的三个信号
北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设的重要举措。由多方参与,采取‘共创、共建、共享’模式,提供六大服务平台,已汇聚近百家生态合作伙伴,由首创郎园负责运营。