「修复率」共找到 457 篇相关文章
一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了
谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。
我日常在用的所有 AI 工具,以及在怎么用
作者分享日常使用的 AI 工具及使用方式,指出 2025 年 AI 进入场景拼杀深水区,产品竞争白热化。介绍各工具在生产力和生活场景的应用,如深度整理、查漏补缺等,认为 AI 替代部分工作,渗透率会增加。
这样更公平:用jina-reranker-m0为多模态文档打分重排
文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。
当下的 AI 产品:有 revenue,但不是 recurring 的
当下AI创企有收入但非经常性,ARR指标被扭曲。因定价权在巨头手里,传统SaaS的ARR已不适用。初创生态封闭循环,未来ARR可能不再是评估方式,新指标或聚焦留存率等。
历史首次!o3找到Linux内核零日漏洞,12000行代码看100遍揪出,无需调用任何工具
OpenAI总裁转发成果,o3模型找到Linux内核SMB实现远程零日漏洞,未用复杂工具。研究员实验对比o3、Claude 3.7和3.5,o3表现佳,还能找到新漏洞、给出完善修复方案。
AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为
2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。
Claude一夜爆更自修bug,PR自己绿了!全球程序员:「摸鱼」正式合法
Claude Code上线「云端自动修复」功能,可自动跟进PR,排查问题、写代码并推送,解放开发者双手。同时,科研团队用其打造Claudini,迭代56次发现新型越狱算法,Claude Code还能自进化写代码。
ACL2025 | 代码助手火了,但安全吗?所有模型评估结果都很扎心
近期,GitHub Copilot、ChatGPT等AI代码生成工具爆火,效率显著提升,但代码安全性存疑。北大团队用CoV-Eval评测20款主流大模型,结果不佳,论文还给出优化方向,呼吁代码上线前严格测试。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。
宇树机器人被曝漏洞,机器人之间可相互感染,官方火速回应
宇树旗下多款机器人被曝存在严重无线安全漏洞,攻击者可借此实现最高权限控制,被攻陷的机器人还会自动扩散感染。发现者此前与宇树多次沟通无果后公开漏洞利用工具链,宇树回应已着手修复。