「顶会研究」共找到 3145 篇相关文章
Claude Code 之父的自白:非科班、辍学,却要革程序员的命
Claude Code创建者Boris Cherny做客访谈,回溯从Meta转至Anthropic的动机,称大模型是新生命形态,影响会重塑社会。还谈及Claude Code发展,从不好用到成主力,揭示软件工程正经历结构性重写。
梁文锋署名!DeepSeek再发炸裂论文:提出“条件记忆”新范式,彻底打破GPU推理显存墙
来自DeepSeek的新论文提出“条件记忆(Conditional Memory)”新范式,推出Engram模块,实现可扩展知识查找。研究揭示U形缩放定律,构建的Engram模型性能超越纯MoE基线,还打破了GPU显存瓶颈。
智能体的记忆管理机制及其潜在风险 | 直播预约
大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。
谷歌创始人布林:当年发完Transformer论文,我们太不当回事了
在斯坦福大学工程学院百年庆典活动上,谷歌联合创始人谢尔盖・布林与校长、工程学院院长对谈。他回顾谷歌发展,称曾对Transformer论文未足够重视,还分享对专业选择、大学模式、学术与产业等方面的看法。
GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了
GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在多方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。
字节即梦张楠:帮人类提升创造力,才是更有意义的「目标函数」
在极客公园IF 2026创新大会上,张鹏与字节跳动即梦张楠探讨人与AI等内容。还放映AI短片《老妈的心愿》,全程由AI创作。张楠介绍合作计划,谈及创作挑战、AI与人关系、Sora与抖音差异等内容。
英伟达巧用8B模型秒掉GPT-5,开源了
英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。
在 Cache-DiT 框架下实现原生 Serving功能
Cache-DiT 是唯品会开源的 PyTorch 原生 DiT 推理加速引擎,此前聚焦离线推理。现实现完整 Serving 功能,支持单卡与分布式推理模式。文章介绍其实现过程、借鉴 SGLang 的设计,还总结踩坑及使用方法。
OCR 创新技术解析丨AI Insight Talk 直播预告
在数字经济下,传统 OCR 技术面临诸多挑战。12 月 4 日 20 点,AI Insight OCR 专场直播将剖析三项突破性 OCR 技术方案,还会有圆桌对谈。分享嘉宾将介绍 HunyuanOCR、PaddleOCR - VL、MinerU 等模型亮点。
AI时代的设计:审美是唯一护城河!
文章指出AI时代设计门槛从会用软件转向有审美。介绍设计门槛转变原因、审美重要性,给出培养审美方法,推荐相关工具,为不会设计的人提供建议,强调审美是AI时代设计唯一护城河。