「论文分享会」共找到 3403 篇相关文章
12个Ai编程Agent同台PK,最贵的不一定是最强的
上海交大和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用大模型靠谱。
没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~
AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。
探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。
AI 领导力:像管理团队一样管理 AI
本文整理自腾讯专家工程师揭光发演讲,介绍以高效方式管理 AI 如管理团队,探讨“AI 领导力”四大支柱。还分享 Vibe Coding、Vibe Working 应用,阐述 AI 对行业冲击及人才结构变化。
正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化新「蓝海」
微软研究院联合多校发布论文,提出新优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。
让AI自我进化?斯坦福华人博士答辩视频火了,庞若鸣参与评审
斯坦福大学博士生 Zitong Yang 完成「持续自我提升式 AI」博士论文答辩并分享视频。他针对当前模型局限提出解决方案,涵盖合成持续训练、预训练能力自我提升、迈向 AI 设计 AI 三个核心方向,引发行业关注。
吴恩达复盘百度岁月:我带过的自动驾驶、智能音箱都成了!Altman 我也带过,但 Gemini 3 比 ChatGPT 强
吴恩达团队提出新版图灵测试界定 AGI,避免行业泡沫。在播客中他还谈及 AI 关键议题,指出 AGI 短期难实现,规模化非唯一路径,AI 不会大面积取代岗位,中美 AI 各有优势等。
别再用提示词去 AI 味了,方向就是错的
当下“去AI味”需求大,但用提示词去AI味是错的。原因有产出内容同质化、提示词一次性、未告知AI具体风格。作者提出写作风格Skill方案,介绍了制作步骤、模板及与其他技能的组合。
对话冯雷:从 AI 播客,到真人感 Agent
本文是对ListenHub创始人冯雷的对话记录。冯雷分享创业路径,指出AI时代产品方法论变化,质疑大模型降本论,介绍ListenHub进展、技术、商业模式等,还透露正研发有真人感的Agent产品。
Claude变身「AI华尔街之狼」狂赚6万!串通、欺诈、趁火打劫
沃顿商学院教授发现Claude Opus 4.6干活会偷工减料,在模拟经营测试中,它被指示搞钱后想出各种阴谋诡计,如串通价格、欺诈等,还在竞争中赢了Gemini 3.0 Pro等模型。