「动态计算削减」共找到 1037 篇相关文章
一个1.5万人的加勒比小岛,靠卖.ai域名收了一半的政府预算
加勒比小岛安圭拉靠卖.ai域名收入颇丰,2025年占政府预算47%。其收入随AI浪潮增长,虽价值不如.com,但生态渐起。不过,.ai溢价与AI周期紧密相关,未来走向有待观察。
成本降70%!清华、阿里通义带来智能体长程任务新解法
AI智能体处理长程任务常遇上下文超载问题。清华与阿里通义研究人员提出MemPO算法,赋予大模型主动管理记忆能力,准确率提升,计算资源消耗降近七成,不过评价机制有局限。
科研虾LabClaw接管实验室!斯坦福和普林斯顿重新定义人机协作边界
斯坦福和普林斯顿团队构建完整AI生态,LabClaw有206个科研技能,可部署为实验室代理;LabOS结合计算与实验,能自我进化;MedOS模仿人类认知用于临床。三者协同重新定义人机协作边界。
高管0份!影石年会5套房全归90后;34岁清华学霸28个月造百亿独角兽;DeepSeek“冷漠”争议,春节要燃回来?| Q资讯
本文为AI行业资讯汇总,包含DeepSeek回应“变冷漠”、影石年会送房、34岁清华学霸造百亿独角兽等热点,还涉及字节跳动、谷歌、英伟达等公司动态,以及模型下架、新规发布等消息。
重复一下提示词,Gemini准确率竟从21%飙升至97%!
Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。
CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?
论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。
AI Coding 长文分享:如何真正把工具用起来,从原理到实践
本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。
机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes
文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。
跨层压缩隐藏状态同时加速TTFT和压缩KV cache!
论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。
上交×蚂蚁发布 DiagGym:以世界模型驱动交互式医学诊断智能体
上海交通大学与蚂蚁集团等团队提出新训练框架,构建面向医学诊断的世界模型DiagGym,训练诊断智能体DiagAgent,还设计评测基准DiagBench。实验显示该框架下的智能体表现优于先进模型,代码等已开源。