「Claude Opus 4.5」共找到 3886 篇相关文章
刚刚,DeepSeek官宣更新了!突然「变冷」冲爆热搜
DeepSeek官宣网页版、APP更新,支持100k token上下文,但更新后性格变冷淡引争议。官方称是效率优先和边界意识所致。此外,传言V4将发布,编程实力或超Claude、ChatGPT等。
35天,版本之子变路人甲:AI榜单太残酷!
LMSYS榜单揭示大模型残酷现实,如Claude 3 Opus从榜首暴跌,大模型“霸主保质期”仅35天,这对应用层开发者是降维打击,未来生存要么做“游击队”,要么挖掘模型无法碾压之物。
PaddleOCR 3.0发布:OCR精度跃升13%,支持多语种、手写体与高精度文档解析
2025年5月20日,飞桨团队发布并开源PaddleOCR 3.0,适配飞桨框架3.0正式版。其提升文字识别精度,支持多文字类型和手写体识别,满足复杂文档解析需求,结合文心大模型4.5 Turbo提升关键信息抽取精度,还新增国产硬件支持。
Anthropic封杀48小时,逼出OpenClaw最强反击!龙虾首次会生视频了
Anthropic封杀OpenClaw免费接口,OpenClaw推出2026.4.5王炸更新,支持视频生成和‘睡眠记忆’系统,还优化提示词缓存。虽与Anthropic有波折,也反映开源项目依赖大厂模型的困境。
研究显示:AI 编程工具在经验丰富的开发者手中表现未达预期
METR研究人员对经验丰富的开源开发者开展随机对照试验,让其使用Claude 3.5和Cursor Pro等AI增强型开发工具。结果显示,AI辅助编程使任务完成时间延长19%,与预期相悖。
两个小时,10美元,Karpathy做了一个《指环王》3D游戏
Andrej Karpathy 让 Opus 5 根据《指环王》开篇文字,用 Three.js 制作三维场景,成本约 10 美元,两小时写出 5500 行代码。虽效果粗糙但有趣,他设想未来大模型能按需生成虚拟世界,不过也暴露大模型难以检查成果的问题。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。
拥有Github 的微软终于出手,发布一键生成全栈应用的GitHub Spark!
微软发布GitHub Spark,能以自然语言生成全栈应用并一键部署,默认用Claude Sonnet 4。它遵循微应用理念,有强大功能体系,深度集成GitHub。开发者看法不一,目前向Copilot Pro+用户开放,或改变市场格局。
AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?
研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。
让AI说人话,Anthropic开源内部最火的skills。
周末,Anthropic官方分享并开源内部常用的skills——eli5,其作用是让AI说人话,解决模型回复冗长啰嗦问题。还介绍了安装方法,指出从opus4.6起,模型coding和agent能力变强但人味淡。