编程Agent」共找到 3502 篇相关文章

7

做AI漫剧的、搞Agent的、投硅谷的,5.20这些赛道顶流碰头了|最新嘉宾阵容

5月20日,量子位将在北京举办中国AIGC产业峰会,主题为「@所有人,马上AI起来」。峰会聚齐百度、智谱等企业实战派,还将揭晓2026年度AIGC企业&产品榜单,发布《2026年中国AI应用全景图谱报告》。

量子位
产品应用7

自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」

在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。

AI寒武纪
开源动态7

Python只是前戏,JVM才是正餐!Eclipse开源新方案,在K8s上不换栈搞定Agent

近期,Eclipse 基金会在开源平台 Eclipse LMOS 推出‘代理定义语言’(ADL)。LMOS 项目旨在用统一、开放方式重构企业级 AI 代理开发与运维链路,对标专有平台与 Python 技术栈,避免企业‘推倒重来’。

InfoQ
开源动态8

LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。

量子位
开源动态8

o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界

GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。

AI科技评论
新闻资讯7

GPT-5编程测评大反转!表面不及格,实际63.1%的任务没交卷,全算上成绩比Claude高一倍

Scale AI的新软件工程基准SWE - BENCH PRO测试中,‘御三家’表面解决率低。深入看,GPT - 5已提交任务准确率比Claude高一倍。该基准新题多、更复杂,能真实考验模型能力,当前模型解决商业问题能力有限。

量子位
产品应用8

Claude Code 史诗级更新!AI 编程进入“反向教学”模式,写到一半会停下考你:这行代码你来写

Claude Code和Claude App推出学习模式,Claude Code支持用`/output-style`定制沟通风格,有Default、Explanatory、Learning三种内置风格,还能自定义,Claude App的Learning风格也全面开放。

AI寒武纪
新闻资讯8

你还在关注大模型排名?这家公司已在全球收割AI红利,做“真正能交付结果的”Super Agents

文章借昆仑万维财报,探讨AI商业化进程。该公司战略重视AIGC,有全面业务场景。其发布的天工超级智能体解决行业痛点,上线APP拓展办公场景。财报显示营收增长,AI业务成引擎,为行业提供借鉴。

量子位
开源动态8

Altman 投的 Agent 终端 Warp 开源了,15小时Star 数飙到3.5万!开源是延长软件寿命的最佳方式

由 Sam Altman 支持的现代终端 Warp 正式在 GitHub 开源,OpenAI 成新代码库创始赞助商。Warp 团队认为传统开发模式遇瓶颈,开源可汇集全球创意,还在功能上开放,引发社区热议。

InfoQ
算法论文7

一个让 AI 智能体(AI Agent)工作更出色的绝妙方法,简单到令人惊讶:只要给它们设定一个人格

论文揭示无需复杂重新训练就能引导AI行为,提出MBTI-in-Thoughts框架,在提示词里让大语言模型扮演特定MBTI人格,其行为会改变,还经测试验证,有广泛应用前景。

宝玉AI