「LLM推理」共找到 2775 篇相关文章
一文读懂:国产AI芯片与英伟达的差距有多大?
文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。
真实联网搜索Agent,7B媲美满血R1,华为盘古DeepDiver给出开域信息获取新解法
华为诺亚方舟实验室提出 Pangu DeepDiver 模型,实现 LLM 搜索引擎自主交互新范式。它用真实互联网数据训练,在 WebPuzzle 等基准测试中,7B 的 DeepDiver 媲美 671B DeepSeek - R1,展现强大信息获取与泛化能力。
提示工程实战指南:从Zero-Shot到Graph Prompting,7大核心技术全解析
随着大型语言模型发展,提示工程成关键技能。文章介绍零样本提示、少样本提示等七种提示优化模式,分析适用场景、优缺点,还给出示例,最后总结各技术适用场景及最佳实践。
ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍
LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。
图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?
图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,如探索具身智能等领域。
更聪明的AI就能随心所欲控制人类?OpenAI科学家笑了:你比猴子聪明,能让猴子听话吗?
本文是科技媒体The Information对OpenAI研究科学家Noam Brown的深度访谈,围绕AI Agent、推理模型、AI安全、OpenAI研发战略展开,披露了Hugging Face多Agent事件细节,分享了诸多反直觉的前沿技术观点,信息密度极高。
马斯克:AI巨浪已至,吸干全球救命钱!
马斯克警告AI激流已至,过去一年全球AI推理Token用量暴增25倍。ARK首席未来学家指出AI基础设施投资回报高,引发资本转移与挤出效应,传统企业融资难、人才流失,将被AI“吸干”资本。
600万奖池尘埃落定,有人靠DeepSeek网页版拿下冠军
TAAC × KDD Cup 2026大赛落幕,600万奖池揭晓归属。大赛吸引52国13913名选手,竞争激烈。冠军团队分别用DeepSeek网页版等工具,在赛题“统一建模”难题上各展方案,其成果或助广告外的LLM研究。
刚刚,Kimi K3开源!3万亿模型权重全球开放
2026年7月27日,Moonshot AI开源全球首个3万亿参数级模型Kimi K3。它不仅参数量大,还在多领域表现出色,能与顶尖闭源模型媲美。其架构创新、训练独特、推理成本低,有望改变全球大模型格局。
阶跃开源JetSpec,大模型推测解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。