论文分享会」共找到 3371 篇相关文章

算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
推荐文章8

Vibe Coding 方法论:不编程的人如何用 AI 写出能跑的代码

文章介绍 Vibe Coding 方法论,即便不编程,也能用 AI 写出能跑的代码。核心是把需求说清楚,还可小步迭代开发,Claude 这类主动询问的工具更适用,同时要明确其适用场景。

宝玉AI
推荐文章8

揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
新闻资讯7

理解与生成统一多模态模型:现状与未来 | 直播预约

从GPT - 4o到Gemini,AI实现跨模态联合理解与生成,核心是统一多模态基础模型。但开源社区构建强大统一模型面临挑战。南大等团队梳理超750篇论文分析技术路线,将有直播探讨现状与未来。

深度学习自然语言处理
新闻资讯7

DataBuddy:数据语义驱动的企业 Agent Runtime 设计与落地|AICon 深圳

2026年AICon深圳站8月21 - 22日举办,聚焦多关键方向。腾讯彭锦文将分享《DataBuddy:数据语义驱动的企业Agent Runtime设计与落地》,拆解DataBuddy相关架构,还介绍演讲痛点、听众收益等,大有10个专题论坛。

InfoQ
算法论文7

揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷

近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这影响训练,论文提出校正算法。

机器之心
新闻资讯7

5555被拒稿,AC接收但PC强拒,NeurIPS揭榜引争议

NeurIPS 2025主接收率24.52%,部分接收论文已影响AI社区或出自年轻学者。但不少研究者遇“高分被拒”,拒稿理由多样,如物理资源限制、缺损失图分析等,引发对评审决策流程质疑。

机器之心
产品应用7

避免Claude Code 降智的一小招

Claude Code近期表现变差,简单代码逻辑搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。

AGI Hunt
新闻资讯8

龙虾让位!硅谷顶流AI「爱马仕」一夜闯进微信,冲上全球第一

硅谷新宠Hermes Agent爆火,GitHub揽6.6万星,原生接入微信引开发者关注。其署名的首篇‘顶级’论文提出Autoreason推理方法,指出传统‘自我优化’弊端,展示出小模型逆袭等优势。

新智元
新闻资讯8

黄仁勋最新访谈:我们已经实现了 AGI,领导力、心理学、生命、意识、死亡和人性

黄仁勋在 Lex Fridman 播客深度对话中,谈及 CUDA 决策、管理模式、四层 Scaling Law 等多话题。认为已实现 AGI,编程定义改变,程序员增多,还分享对供应链、开源等看法。

AGI Hunt