「在离线混部」共找到 8278 篇相关文章
扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧
上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。
机器人杭州上演格斗赛!拳拳到肉,宇树CEO王兴兴:创造了人类历史新时刻
全球首个人形机器人格斗赛在杭州落幕,四支队伍用宇树科技G1机器人参赛,“AI测算师”夺冠。比赛分表演赛和竞技赛,考验机器人多方面能力,背后是软硬件协同升级,引发网友热议。
OnlyFans和AI女友,谁会是最后的赢家?
OnlyFans以80亿美元估值寻求出售,此时AI女友市场正疯狂扩张。OnlyFans有真实性、商业生态等底牌,AI女友有成本和个性化优势。二者各有软肋,未来或市场分化,技术进步或使天平向AI倾斜。
最强编码模型Claude 4来了!Mcp集成无需Client,扩展提示缓存增强Agent长上下文保持能力
Anthropic 昨日推出新一代 Claude 模型,包括 Claude Opus 4 和 Claude Sonnet 4,在编码、高级推理和 AI Agent 方面树立新标准,有卓越编码能力、显著提升的 Agent 能力、全新 API 功能,Claude Code 也全面上市。
AI编码新神登基,藏师傅一手Claude 4实测
Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码和记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。
终于,无需邀请码,这款刷新GAIA榜单的Agent你立刻就能用!
今年AI圈新品爱用邀请码等三件套,作者对此不满。天工超级智能体(Skywork)不玩套路,在GAIA评测达SOTA级别。它优化办公三件套场景,使用方便,虽有不足但瑕不掩瑜。
PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)
当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。
AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!
匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
Llama 4万亿巨兽延期,80%核心元老集体辞职?
Meta旗舰AI模型「Behemoth」发布一再推迟,内部对公司AI战略质疑达顶峰,还传出约80%团队辞职消息,虽已辟谣但仍引发担忧。Meta AI发展遇困境,对手却在快速迭代。