「战略推理」共找到 2382 篇相关文章
一篇文章告诉你:国产 GPU 背后的技术和商业路线异同
过去两年,国产 GPU 赛道进入公开财务与审视阶段。文章分析了摩尔线程、沐曦等企业不同技术与商业路线,如摩尔线程走“高启动+快扩张”,沐曦选“厚积薄发+先服务高端算力场景”等。
跨层压缩隐藏状态同时加速TTFT和压缩KV cache!
论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。
三位AI殿堂级人物罕见同框:LeCun、李飞飞、谢赛宁团队用空间超感知让AI像人一样理解三维世界
谢赛宁团队联合杨立昆、李飞飞发布Cambrian - S研究,提出空间超感知概念,指出现有AI视频理解或被高估,推出VSI - SUPER基准测试,虽Cambrian - S模型有提升但仍有局限,预测性感知或成新范式。
3个月融资亿元,流形空间证明世界模型也需要预训练 | 甲子光年
2025年5月武伟创办流形空间,成立3个月获亿元融资。他认为VLA是过渡方案,世界模型是AGI新基建。当下技术分显式物理建模和隐空间交互两派,流形空间做具身世界模型,从预训练做起,还将领域模型产品化。
李飞飞万字长文爆了!定义AI下一个十年
李飞飞最新长文指出,AI下一个前沿是「空间智能」,它能让「看见」升华为「推理」等。她揭秘了空间智能「世界模型」核心框架和三大核心支柱,还阐述了其应用领域及构建挑战。
Kimi K2 Thinking,最强思考模型,附实测
Moonshot AI发布Kimi K2 Thinking模型,它能边思考边行动,是目前最强开源思考模型,多项指标超GPT - 5等闭源巨头。其具独特架构,有性能优势,还给出部署方式,实测表现佳。
Meta裁员、OpenAI重组:万字复盘谷歌起笔的AI史诗,如何被「群雄」改写剧本?
近期AI公司动作不断,Meta、OpenAI等有重大变动,显示行业从“淘金热”转向“阵地战”。文章复盘AI发展,以谷歌为主线,穿插其他巨头历程,还结合当下现状深度分析发展与战略博弈。
2篇论文,最新上下文工程技术一次性讲透!
上下文工程技术持续火热,文章分享10月两篇相关论文。ACE让模型给自己写「战术板」,在多任务表现优;SA - ICL让LLM先搭框架再做题,在化学/物理准确率提升显著,还对二者做了横向对比。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
重磅!OpenAI官宣自研AI芯片:垂直整合要彻底摆脱英伟达,联手博通部署10吉瓦算力
OpenAI与博通达成深度战略合作伙伴关系,共同设计和制造AI芯片与计算系统,合作已秘密进行约18个月,目标是2026年底部署10吉瓦算力,还在用模型探索芯片设计新方法。