「推理驱动」共找到 2617 篇相关文章
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。
Sam亲自泼冷水,GPT-5意外失手:我们对AI的期待,是否已被整个行业误判?
科技行业集体转向 AI,高管强调其变革性,可 OpenAI 的 Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。
仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架
阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。
MIT成果登Nature正刊:90天,「AI科学家」完成3500次电化学测试
美国麻省理工学院李巨团队在Nature发表论文,展示多模态机器人平台CRESt。它结合多模态模型驱动的材料设计与高通量自动化实验,大幅提升催化剂研发速度和质量,还解决了实验结果可重复性不足问题。
英伟达用NIM + NV-Tesseract模型,提高芯片生产良率
芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。
告别微调!斯坦福提出Agentic上下文工程
当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。
让大模型学会“像人一样”查证真伪
伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。
Gamma完美开源平替,输入主题一键生成专业PPT,配图排版全自动!
做PPT耗时耗力,现有AI驱动PPT生成工具多为闭源SaaS服务。GitHub上的开源项目presentation-ai是Gamma的开源平替,输入主题可自动生成PPT,功能丰富,还给出安装部署步骤和使用场景。
The Batch: 876 | Gemini 的环境影响测算
谷歌研究人员对驱动 Gemini AI 助手的模型进行一年研究,发现处理一个提示的环境影响小。其能耗、水耗和温室气体排放量远低于此前估算,2024 - 2025 年处理中位提示时能耗、排放大幅降低。
郭台铭,重回首富宝座
曾经放言“给大陆赏饭吃”的郭台铭,因工业富联市值突破万亿,再次被大陆资本市场推上中国台湾首富宝座。工业富联在AI算力基础设施领域表现抢眼,其AI服务器业务成增长主力。郭台铭海外投资受挫后回归内地,推动公司转型。