「论文调试」共找到 1076 篇相关文章
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
最新最完整的Agent Memory综述!
《Memory in the Age of AI Agents: A Survey》由多顶尖机构联合发布,对AI智能体记忆机制系统梳理。从形式、功能、动态维度厘清AI记忆本质,提出构建下一代强人工智能的蓝图。
清华姚班大神陈立杰,联手00后逆向破局!颠覆50年计算机难题
50年来,顶尖科学家死磕「旅行商问题」等计算机复杂性难题无果。清华姚班陈立杰等人在《Reverse Mathematics Below the Turing Jump》论文中,采用「逆向数学」方法,发现许多理论底层逻辑等价,颠覆千年思维范式。
最具争议性研究:大模型中间层输出可 100% 反推原始输入
意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。
大模型公司不搞浏览器搞Agent,实测找到原因了
文章实测阶跃星辰桌面Agent小跃,它能操作命令行,可自然语言驱动计算机功能,有悬浮球形态,能联网、搜索、处理表格等,还支持复用操作、定时任务,但也存在速度慢等不足。
vLLM 新特性:批量大小不再影响模型输出
vLLM 推出批量不变推理功能,解决大模型推理中相同输入在不同批量大小下结果不同的问题。设置 `VLLM_BATCH_INVARIANT=1` 可保证输出一致,技术实现含三部分,虽有性能开销但换来了结果确定性。
硅谷CEO们高喊AI威胁论,「5年内失业率飙升至20%」,但95%AI项目赔本赚吆喝
当下‘AI 威胁就业’论调甚嚣尘上,如Anthropic等公司高管预测失业率飙升。耶鲁大学论文分析AGI经济中人类劳动地位。但MIT报告显示,95%公司AI项目未获商业回报,多数试点停滞。
Cursor现在可以直接控制浏览器了
随着Claude4.5发布,Cursor更新了“@Browser”,可控制浏览器、截图、改进UI、调试客户端等。无需安装其他工具,任何模型输入@browser即可控制浏览器,在Windows下调用顺滑,需启用预览版功能。
Notion、Stripe 都在用的 Agent 监控,Braintrust 会是 AI-native 的 Datadog 吗?
当 Agent 迈向产品化,开发者面临观测、评估和优化黑箱系统的挑战。Braintrust 由 Ankur Goyal 于 2023 年创立,重塑 Observability,提供 Eval 和 Ship 模块,获多家头部公司青睐与投资。文章从多方面剖析其能否成 Agent 时代‘新 Datadog’。
OpenAI解释LLM为什么会有幻觉
OpenAI和佐治亚理工联合论文《Why Language Models Hallucinate》深入探讨LLM幻觉根源,指出预训练阶段统计本质和评估体系激励扭曲是主因,还提出改革评估体系引入显式置信度目标的解决方案。