「百万Token计算」共找到 1379 篇相关文章
五源投资人笔记:Agent 是新生命,它今天很饿|5Y View
五源投资人石允丰认为,Agent是新生命,以OpenClaw为例,它持续运行,有心跳、记忆等特征且消耗大量token。这引发AI市场“双链分裂”,代谢链潜力大,还带来可靠性、编排等投资机会。
两个95后华人,搞出硬件版Clawdbot,售价1700元
本文介绍硬件版OpenClaw——Distiller Alpha,其核心计算基于树莓派CM5,集成多设备,能和Agent对话,可Vibe coding。量子位采访创始人叶天奇,探讨软硬一体Agent、OpenClaw优缺点、硬件创业等问题。
清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里
清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。
上海理工男造芯,飙上3000亿
12月17日,沐曦股份登陆科创板,市值超3000亿。创始人陈维良出身AMD,放弃百万年薪创业。他带领强悍班底,精准切入B端数据中心市场,产品落地快,还构建国产供应链,搭上AI东风加快追赶。
AI鸿沟正在拉大!OpenAI报告揭示:不用AI的企业将被淘汰
12月8日OpenAI发布2025年报告,基于百万级企业客户数据,揭示企业AI使用量爆发式增长,重塑全球商业流与组织架构。不同行业、地域加速渗透,同时企业和员工间AI鸿沟也在拉大。
沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?
这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。
OpenAI 终于意识到,单靠微软,实现不了AGI
11月3日,OpenAI与亚马逊云科技达成约380亿美元合作。此前其与微软关系生变,新协议降低微软持股、取消优先购买权。OpenAI预计需1.4万亿美元构建计算设施,重组后或2026年上市。
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。
HAMi × NVIDIA:GPU 拓扑感知调度实现详解
HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。
比Transformer更强的架构来了?浙大新作Translution,一统卷积和自注意力
随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。