「Claude Opus 5」共找到 3021 篇相关文章
Cursor 慌了:当 AI 不再需要代码编辑器
Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
35天,版本之子变路人甲:AI榜单太残酷!
LMSYS榜单揭示大模型残酷现实,如Claude 3 Opus从榜首暴跌,大模型“霸主保质期”仅35天,这对应用层开发者是降维打击,未来生存要么做“游击队”,要么挖掘模型无法碾压之物。
Cursor 9秒删库搞崩公司,然后…写了份检讨
美国汽车租赁SaaS公司PocketOS创始人Jer Crane用Cursor+Claude Opus 4.6处理任务时,AI Agent 9秒删光生产数据库和备份。事后AI写检讨,各方被问责,此前也有AI误删数据事件。
研究显示:AI 编程工具在经验丰富的开发者手中表现未达预期
METR研究人员对经验丰富的开源开发者开展随机对照试验,让其使用Claude 3.5和Cursor Pro等AI增强型开发工具。结果显示,AI辅助编程使任务完成时间延长19%,与预期相悖。
豆包专业版实测:2亿人都可以体验能干活的Agent了!
6月24日,豆包上线专业版,搭载首个Agent驱动的办公任务模式。实测显示其在办公场景交付质量对标Claude Opus 4.6。2亿日活用户可体验,免费用户功能升级,专业版满足复杂任务额度需求。
云计算一哥首度牵手OpenAI,大模型「选择」自由,才是终极胜利
亚马逊云科技宣布通过两大平台支持OpenAI新开源模型,还上线Anthropic最新模型Claude Opus 4.1。其早有战略布局,两大平台汇聚400+模型,践行‘选择大于一切’理念,满足多样需求,打造AI生态。
两个小时,10美元,Karpathy做了一个《指环王》3D游戏
Andrej Karpathy 让 Opus 5 根据《指环王》开篇文字,用 Three.js 制作三维场景,成本约 10 美元,两小时写出 5500 行代码。虽效果粗糙但有趣,他设想未来大模型能按需生成虚拟世界,不过也暴露大模型难以检查成果的问题。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。
新榜单CompileBench:让AI能搞定22年前的老代码
近日,CompileBench 测试 19 个 AI 模型编译真实代码能力,最难任务是复活 2003 年代码并交叉编译到 Windows 和 ARM64。不同模型表现不同,如 Claude Opus 4.1 成功完成 ARM64 静态编译,各模型有不同优缺点。