「推理加速技术」共找到 4963 篇相关文章
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
美团开源全模态,比肩顶级闭源模型,开源新SOTA
美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。
刚刚!Kimi Linear横空出世,全新注意力架构:1M长文本解码速度飙升6.3倍,KV缓存砍掉75%
月之暗面推出全新注意力架构Kimi Linear,有望成下一代Agent LLM基石技术。它解决了LLMs处理长序列任务的瓶颈,性能超传统机制,还开源了核心代码。Kimi Linear的KDA模块提升了表达和硬件效率,实验表现佳。
NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍
自回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。
医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!
百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。
GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o
浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。
深谋商业化一骑绝尘!人形机器人中标国网电力,大载重eVTOL即将首飞
深谋科技在今年世界人工智能大会上大放异彩,其融合多模态感知检测的人形机器人中标国网河北电力项目,相关技术将应用于关键研究和装置研制。此外,其大载重eVTOL曜眸MX150E无人机即将首飞量产,有望成低空经济出海冠军。
张小珺采访了Kimi杨植麟,Agent泛化的临界点来了。
张小珺采访Kimi杨植麟,杨分享技术见解。如Scaling Law遇瓶颈,应提升Token效率;Adam与Muon对比,Muon学习效率高;模型公司下场做一方Agent产品,垂直整合模式上限高;还谈及长上下文、Agent训练及管理方式等问题。
上下文记忆力媲美Genie3,且问世更早:港大和可灵提出场景一致的交互式视频世界模型
交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港大和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。
AI 眼镜“秒变”直男程序员“脱单神器”,首次亮相被抢购一空!CEO 坦言:好产品要么能帮用户赚钱,要么能解决实际痛点
拂曦科技CEO段然分享AI眼镜创业经历。AI眼镜行业发展有趋势也有瓶颈,拂曦科技从B端转C端,其恋爱眼镜首秀被抢空。还谈到技术挑战、市场教育及未来爆款场景,强调场景是核心竞争力。