「非线性多智能体推理」共找到 5146 篇相关文章
缓存不该困在一台服务器里
本文分析大模型推理阶段KV缓存的行业痛点,指出传统单机缓存孤立无法跨节点复用的问题,介绍焱融科技的分层共享缓存方案,公开了方案的实测性能数据,展现AI存储的新发展方向。
刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架
8月大模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。
一台工业具身机器人,从理想到现实要经过哪些坑?
在具身智能赛道,‘落地’常被滥用。聆动通用在‘工业落地’上很果决,以‘商业有闭环’和‘批量可复制’为核心指标。他们选择物流场景起步,推出LDB机器人,还面临量产和运营难题。
斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026
8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。
清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源
5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。
ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代
随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。
黄仁勋,开启智元(Token)时代
全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。
一句「你还好吗」值40亿?斯坦福博士出走xAI,押注AGI共情力
AI已足够聪明,却不够温柔。斯坦福博士Eric Zelikman离开xAI,创立Humans&,以40亿美元估值筹集10亿美元,要打造具「情感智能」的模型,让AI学会理解人,资本也开始为「共情」下注。
突然发现,谷歌的 AI Mode “免费、全面”地开放了
上个月谷歌在 iOS 和安卓的 Google App 全面开放 AI Mode,现几乎对所有能访问 google.com 的地区免费开放。它基于 Gemini 2.5 等模型,能智能答问、对话交互,还植入 Agent 功能,变革搜索体验。
邱锡鹏团队新作:让机器人学会「察言观色」
复旦大学邱锡鹏团队等发布全新操作框架 RoboOmni,突破传统 VLA 依赖显式指令局限。它融合多模态信号,构建数据集,在成功率等方面超基线,以跨模态指令让机器人主动推断意图,开启具身智能‘共情时代’。