「代码修复评测」共找到 2323 篇相关文章
OpenCode AI编程实践:利用推理路由低成本开发游戏
文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其按任务选模型,多数任务路由到 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。
半价干翻Fable 5?Opus 5实测炸场,网友:差点从椅子上摔下来
Anthropic新模型Opus 5登场,多项评测中追平或反超Fable 5,价格仅为一半。网友实测表现出色,还具备硬核自检流程,性价比高。另外,Claude Code提示词删减八成,成绩未降。
Claude有「编制」了!Anthropic发的
6月23日,Anthropic发布Claude Tag,它是常驻Slack频道的AI团队成员,有自己的身份、账号和审计轨迹。其核心是权限架构,采用智能体身份,按用量计费,已对企业版和团队版客户开放beta。
刚刚,OpenClaw和Cursor杀入手机!Agent从此塞进口袋
OpenClaw和Cursor同日发布原生App,OpenClaw上架全血原生App,可无缝交互,解锁设备底层能力;Cursor发布iOS应用公开测试版,可让开发者在手机上指挥代码开发,重塑人类工作方式。
ICLR 2026 | 救命,手机Live Photo重选封面终于不糊了
vivo 蓝图实验室与南开大学联合发布研究,被 ICLR 2026 接收。该研究定义了 Live Photo 重选封面帧修复任务,提出 LiveMoments 方案,利用原始封面帧作参考提升画质,实验表现优,应用场景广。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
跑分第一,推理暴跌!Claude Opus 4.7上线48小时口碑崩了
Claude Opus 4.7发布48小时口碑两极撕裂。官方榜单并列全球第一,但逻辑推理公开测试成绩暴跌,token消耗涨35%,旧接口报错,用户吐槽「更贵、更蠢、更爱顶嘴」,Anthropic虽解释却难平用户怒火。
在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节
4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、大语言模型等热门领域成果,展示解决大模型痛点的研究。
The Batch: 940 |Claude Mythos Preview 引发安全担忧
Anthropic为即将推出的Claude Mythos Preview采取特别预备措施,因其会带来网络安全风险。该模型能力强大,能发现众多代码漏洞。Anthropic组建联盟增强防御,其表现也优于多个知名模型。
Claude Code 终端工具链完全指南:7 款终端横评 + 我的最佳实践
文章对 7 款主流终端进行横评,给出 Shell 配置、终端复用器、快捷键的最佳实践,旨在让 Claude Code 体验更顺滑。介绍各终端特点,避坑 Powerlevel10k,推荐 Starship,强调 tmux 重要性等。