长程执行能力」共找到 3646 篇相关文章

算法论文8

Agent接管EDA工作流,不只写脚本!浙大打通真实芯片设计闭环

大模型正以Agent形态进入真实EDA工具链。浙大卓成团队构建OpenClaw + FluxEDA联合架构,打通关键链路,解决模型操作真实EDA工具的难题,在多任务中完成连续分析与优化闭环,推动EDA工作流范式转变。

新智元
算法论文7

世界模型开始做减法?LeCun团队和清华团队给出两种思路

近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。

机器之心
产品应用8

月耗3000美金的Skills重度用户,实测MiniMax M2.7:国产Agent模型的天花板?

AI产品黄叔作为月耗3000美金的Skills重度用户,实测MiniMax M2.7,从多Agent协作、Coding能力、办公自动化等多方面测试,发现其表现出色,虽有不足,但在多维度已是国产模型天花板。

AI产品黄叔
算法论文8

生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收

现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。

量子位
推荐文章8

从“暴力烧Token”到“系统工程”:OpenAI与华为的两条 AI 编程路径

文章对比OpenAI与华为的AI编程路径,指出模型中心派靠推高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。

InfoQ
算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
推荐文章7

AI x 大前端性能稳定性:快手亿级 DAU 下的智能诊断实践

本文整理自快手移动端稳定性负责人李锐在 2025 年 QCon 大会的分享。介绍快手大前端性能稳定性挑战,阐述借助「柯南 AI」赋能排障的实践,含根因排障和应急处置案例,还谈了开发中思维切换等认知。

InfoQ
开源动态7

OpenClaw 之后,Agentic RL有了新训练范式

大模型技术推动AI从‘回答问题’迈向‘执行任务’,Agentic AI兴起。中国科大认知智能全国重点实验室提出Claw - R1项目,将前沿Agent Runtime与强化学习训练框架结合,为Agentic AI提供新训练基础设施。

PaperAgent
开源动态8

Qwen3-ASR的MLX原生实现:让SOTA语音识别跑满苹果芯片

Qwen3 - ASR是强大开源语音识别模型,但官方实现无法充分利用苹果芯片GPU能力。开发者完成MLX重写,让其能在苹果芯片上原生运行,实测性能佳,还有诸多核心功能及安装使用示例。

AI工程化
产品应用7

字节的 Doubao Seed 2.0 来袭,不过我想先和你聊聊扣子编程

作者介绍了AI Coding进展超预期,普通人协作就能做出实用作品。重点讲了扣子编程,它是云端Coding Agent,适合小白,接入多个大模型。还介绍了Doubao Seed 2.0升级,最后探讨了编程趋势。

MacTalk