「具身规划模型」共找到 8455 篇相关文章
开源即登榜!登顶全球前十AI编程智能体,UCL初创团队开源Prometheus
UCL初创团队EuniAI开源AI软件智能体Prometheus,在SWE - bench Verified上Pass@1达71.2%,成绩入官方主榜。它有图结构推理设计,能理解代码,成本低,官网有Demo展示其工程化能力。
卡帕西8000行代码手搓ChatGPT,成本仅100美元,训练12小时CORE表现超越GPT-2,手把手教程来了
AI大神Andrej Karpathy新作nanochat,用8000行代码、100美元成本纯手搓克隆ChatGPT。它是极简全栈训练/推理pipeline,训练12小时,CORE表现超GPT - 2,还给出快速上手详细指南。
两份报告,两种 PMF:ChatGPT 跑通了 Copilot,Claude 验证了 Agent
OpenAI和Anthropic发布核心产品使用报告,展现ChatGPT和Claude用户心智差异。ChatGPT像Advisor,以询问、写作为主;Claude似Agent,随模型能力提升,用户倾向用其执行自动化任务。
攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理
美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。
AlphaGo作者领衔,8个机械臂协同干活0碰撞,DeepMind新作登Science子刊
DeepMind等机构成果RoboBallet登Science子刊。它将图神经网络用于强化学习,可控制8个机械臂协同无碰撞工作。核心是结合图神经网络与强化学习,解决多机器人协作复杂问题,实验表现出色。
Claude Code 开发者谈如何用 Claude Code 开发 Claude Code
Anthropic的Claude Code创建者Boris Cherny在访谈分享智能体编程未来看法,介绍用Claude Code开发它自身的方法,还谈及Claude Code发展、使用技巧及对编程工作未来变化的预测。
抢天才还是拼算力?前 Llama 推理负责人详解 AI 的真实天花板
前 Llama 推理负责人 Ross Taylor 在播客访谈中指出,AI 竞赛中的混乱和挖角是噪声,最终会被指数级算力淹没。他阐释了算力指数曲线决定竞赛天花板,强调系统性实验、高质量评估的重要性。
关于Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti的理解
文章分析Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU上特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。
含全文!OpenAI发布GPT-5官方Prompt指南
OpenAI 发布《GPT-5 prompting guide》,介绍新模型变化及使用方法。新增 `reasoning_effort` 和 `verbosity` 参数,还有 Responses API。Cursor 分享实战心得,同时提及控制 Agent 积极性、解决指令冲突等内容。
Windsurf 的甩卖对 AI 编程生态意味着什么?
Windsurf八个月内ARR达8200万美元,却被低价甩卖。其负利润率高,靠烧钱补贴成本,面临API成本高、竞品低价冲击等问题。此事件揭示编程工具价值捕获难,凸显基础设施等环节价值。