「代码执行模拟」共找到 2305 篇相关文章
Claude Cowork 推出新功能 Dispatch:Claude 从此开启「异地办公」
Anthropic为Claude Cowork推出新功能Dispatch,能让用户用手机给电脑上的Claude派任务。它代码本地运行,保障数据安全,还支持持久对话。目前已对Max订阅用户上线,不过存在多设备支持等问题。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
AI打通第一/第三人称视觉,跨视角视觉理解新SOTA|ICCV 2025 Highlight
INSAIT、复旦大学等联合提出ObjectRelator框架,让AI精准匹配不同视角下同一物体,实现跨视角统一表征与理解。它在Ego转Exo和Exo转Ego任务上超基线模型,已被ICCV 2025接收,代码开源。
GPT-5:没有AGI,失望和天花板,最具竞争力的可能是定价
刚看完GPT - 5发布会,整体令人失望。发布会现错误图片,市场反馈不佳,专家认为开发仓促。它有三个型号,基础性能表现不一,在部分测试中不如竞品,亮点是价格有竞争力,代码能力受开发者好评。
终于在国产AI上看到了Opus的影子|GLM-5深度实测
作者起初怀疑GLM - 5称对标Claude Opus 4.6、定位“系统架构师”的说法,但实测后改观。通过宝可梦策略助手、降噪网站沉浸式交互、求职招聘双边匹配三个测试,展现其系统规划、执行、纠错等能力,像真正架构师。
卡帕西都整破防了:AI Coding没门槛,可部署环节真嗯啊的难
AI Coding界明星卡帕西公开吐槽,代码不再是AI编程瓶颈,部署才是。他以自己开发「菜单图片生成器」的经历为例,指出部署环节问题频发。他认为应让AI调用和配置,还推荐了Stripe Projects等优化产品。
GUI 将死,CLI 才是一切
文章指出 GUI 时代将尽,CLI 正赢下一个十年,其用户将是 Agent。介绍了 CLI - Anything 项目,它能为软件生成 CLI 接口,让 Agent 用命令行操控软件,还探讨了 Agent 命令执行权限等问题。
模力工场 032 AI 应用榜:桌面 Agent 强势来袭,阶跃登顶本周榜首
模力工场032周AI应用周榜出炉,25款应用上架。本期用户讨论最高的是桌面Agent形态,AI从“对话框助手”走向“接管桌面执行者”。还精选十款应用解读行业风向,反映AI正进入执行与交付阶段。
LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力
来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。
苹果出手!改进GRPO,让dLLM也能高效强化学习
苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。