「自动化编译管线」共找到 565 篇相关文章
榨干Codex!OpenAI工程师亲授Codex真正用法
OpenAI客户支持工程师Jason称,Codex不只是编程助手,而是完整电脑工作系统。通过持久对话流留存记忆、语音输入精准表达、自动化接管任务等,能让机器高效完成各类工作,人还可随时干预。
首个接入GPT-5的视频Agent!一句话生成商业级广告大片,分镜配音字幕等全包了
AI视频生成进入Agent时代,Video Ocean是首个接入GPT - 5的视频Agent,输入提示词就能自动完成分镜、画面等生成爆款视频。它有自动化创作生态系统,操作简单,新手也能上手。
XBOW 发现Wordpress 任意文件读取漏洞的过程
XBOW用AI系统做全自动化渗透,在HackerOne排名第一。其博客文章分享发现WordPress Ninja Tables插件任意文件读取漏洞的过程,从侦察端点到编写脚本攻击,最终确认漏洞并进行了负责任披露。
Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
卷赢OpenAI也没用!Salesforce用100万次对话揭秘:AI Agent最大的坑,根本不是技术!
Salesforce处理超100万次AI Agent与客户对话后复盘,指出行业追求“全自动化”是陷阱。AI Agent不仅要融合非结构化和结构化数据,还需提升人工介入率,遵循“同理心优先”原则。
再见,程序员!马斯克宣判:奇点就在2026
马斯克断言2026年是奇点之年,起因是Claude Code强大的编程能力引发关注。Claude Opus 4.5表现优异,碾压其他模型。奇点来临,人们工作方式将改变,AI或使软件开发自动化。
通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果
阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模型自主交互学习。基于此训练的AgentScaler模型,数十亿参数就达万亿级模型性能,为轻量级代理智能发展带来新可能。
DeepSeek“极你太美”bug,官方回应了
DeepSeek V3.1调用API开发时输出常现“极”字,在火山引擎、腾讯CodeBuddy等多平台出现,影响代码编译。官方称将在近版本修复,网友猜测或因数据清洗不彻底。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来大语言模型在长篇视觉叙事中潜力卓越,但长视频剪辑仍难控制。中科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑中的机制,重构剪辑管线,找到症结并给出解决办法。
DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单
在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。