「接种提示法」共找到 801 篇相关文章
AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华
随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。
实测可灵3.0 - 属于每个人的导演时代。
可灵更新至3.0版本,将视频模型能力提升到新高度。它有分镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。
比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题
斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。
Sam Altman 与开发者的一小时:GPT-5 的坦白、招聘放缓、以及 2026 年最担心的事
2026 年 1 月 27 日,Sam Altman 在 OpenAI 开发者 Town Hall 上回答广泛问题。他承认 GPT - 5 写作搞砸,宣布大幅放缓招聘,称若 2026 年 AI 出大问题,生物安全或成合理押注,还谈及软件工程、GTM 等多方面看法。
刚刚,Anthropic分享了他们在AI Agents评估的最佳实践
Anthropic发布blog《揭秘AI Agents评估》,指出良好评估能助团队信心发布AI智能体,介绍评估结构、构建原因、评估方法、从零到一的路线图,还提到评估需与其他方法配合,全面了解智能体性能。
把 AI 邮件工具做到 3500 万美元 ARR,Superhuman:找到 PMF 其实有明确的方法论
文章以 Superhuman 为例,介绍其找到产品与市场契合点(PMF)的方法论。从用户调研、开发模式、找准核心等方面构建 PMF 策略,还阐述衡量及优化 PMF 的方法,如关键指标、四步法等。
智能体崛起,AI+软件研发到新拐点了?
InfoQ《极客有约》X AICon 直播邀请多位嘉宾探讨 LLM 时代软件研发新范式。指出 AI 在测试中多为提效工具,距“原生开发时代”尚远;Coding Agent 潜力大;还谈及 AI 应用场景、落地问题、人员能力要求等。
Nano Banana 2突然现身!能画公式解数学题,监控画面都能伪造
Nano Banana 2代以预览版现身第三方网站,后被移除。其能力远超1代,能处理复杂提示,可生成复杂UI、解数学题甚至伪造监控画面。谷歌正将Nano Banana整合进核心产品生态。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
当AI开始设计芯片
英国XMOS芯片设计公司正研发GenAI工具,能用自然语言提示配置Xcore处理器硬件特性。这不仅能重塑芯片设计流程,让不同背景的人参与设计,还推动商业模式从卖硬件转向卖确定性,挖掘芯片“时间价值”。