「Claude模型」共找到 8669 篇相关文章
Mamba核心作者新作:取代DeepSeek在用的注意力机制,专为推理打造
Mamba核心作者Tri Dao团队提出GTA和GLA两种专为推理定制的注意力机制,在减少KV缓存用量、保持模型质量的同时,显著提升解码速度,优化长上下文推理能力。
从性能到实战,怎样才算是靠谱的 Agent 产品?
红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。
豪掷30亿美元,OpenAI史上最大收购案!
彭博爆料OpenAI将豪掷30亿美元吞并AI编程工具Windsurf,这是其史上最大规模收购。Windsurf因模型无关性设计等优势脱颖而出,此次收购或重塑AI编程市场格局。
万星skill作者:用Opus 5.5,先把视频skill卸载了
本文分享了GitHub万星项目video-shotcraft作者Vincent的最新观点,Opus 5.5仅需一句话就能生成包含BGM、音效的完整视频,无需额外视频制作skill,引发对AI技能价值的讨论。
教机器人干活,光“刷课时”可不够!灵初这次较真数据质量
本文聚焦机器人学习人类操作的数据痛点,灵初智能提出逆向生成强配对数据的新思路,升级Psi-R2.5模型,提升数据可用性,降低新任务适配成本,方案已落地客户现场。
DeepSeek Harness 保姆级教程:安装配置、模式详解、Token消耗&竞品对比
本文是DeepSeek Harness的保姆级教程,从零讲解这款开源AI Agent运行框架的核心特性、安装部署、功能模式、Token消耗机制,横向对比主流竞品给出选型建议,新手也可快速上手。
OpenAI官宣GPT-6 Astra,AGI时代要来了吗
OpenAI官宣GPT - 6 Astra,自称‘世界上最聪明、对齐最好的模型’,总裁称迎来AGI时代。它成绩亮眼,能直接完成工作,达网络安全阈值,训练让AI深度参与,但价格较贵。
智能体请求暴增 9.4 倍,token 账单却没涨:Uber 公开 AI 软件工厂省钱方法
AI 工具已嵌入 Uber 软件开发各阶段,智能体请求量增长 9.4 倍,但 AI 总支出自 4 月相对稳定。文章介绍其软件工厂思考,包括智能体会话层级、成本公式、指标测算及优化手段,还提及未来举措。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。
夜光影像里的"暗船":双分支 YOLO11 如何用抓非法捕捞
非法捕捞的暗船常关掉 AIS 隐身,难被传统手段监控。论文提出双分支 YOLO11,通过夜光遥感数据精准检测,还设计预处理流程,在测试集表现优,规模化应用也得到暗船率等成果。