系统2慢思考」共找到 3964 篇相关文章

算法论文8

YC总裁转发、登顶Hacker News:SkillsBench揭开Agent技能扩展的残酷真相

近日论文《SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks》引发海外AI社区关注。研究聚合47150个Skills,经严格筛选评估,揭示人工构建Skills效果好、AI自生成无效等核心发现,为AI研发指明路径。

机器之心
7

我花499找人上门安装OpenClaw,看到了AI时代最魔幻的一幕。

作者花499元体验OpenClaw上门安装服务,发现市场价格混乱,从30到5000元不等。安装师傅非技术出身且自己少用该工具。同时指出OpenClaw有安全隐患,提醒大家别因恐惧盲目安装。

数字生命卡兹克
产品应用7

Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局

Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。

AI工程化
开源动态7

浏览器秒变 Mac 终端,有点意思!

介绍开源工具 VibeTunnel,它能把浏览器变 Mac 终端,支持远程操控。零配置、跨设备、实时同步,无需 SSH 密钥等。有跨设备访问等多种特性,给出不同系统安装方法和使用步骤。

开源先锋
产品应用8

像Vibe Coding一样写论文!OpenAI发布免费科研写作平台

OpenAI发布免费科研写作平台Prism,将GPT - 5.2集成到在线LaTeX编辑器,功能强大。其背后是OpenAI进军AI4S领域战略,副总裁Kevin Weil称2026年将成科学界‘AI变革年’。

量子位
算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent
技术实践8

RTP-LLM 在相关性大模型中的推理优化最佳实践

淘宝搜索场景引入大参数LLM模型,面临系统性能挑战。本文分享基于RTP - LLM框架的优化实践,如大BatchSize调度、批次内前缀复用、MoE Kernel动态调优等,还提及未来优化方向。

阿里云开发者
新闻资讯8

谷歌发布适用于多智能体的八种设计模式

谷歌发布多智能体系统八种核心设计模式指南,涵盖顺序流水线到人工介入架构等范式,对每种模式清晰解释,还附谷歌 Agent Development Kit 示例代码,助开发者结构化设计系统

InfoQ
算法论文8

人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练

人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。

AI科技评论
产品应用8

《生成式AI卓越架构设计指导原则》:从"能用AI"到"用好AI"

2025云栖大会上,阿里云发布《生成式AI卓越架构设计指导原则》,以云原生“卓越架构五大支柱”为基础,针对大模型内容合规与安全治理等领域提建议,助力企业从‘能用AI’走向‘用好AI’。

阿里云开发者