仓库级代码」共找到 2500 篇相关文章

算法论文8

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。

新智元
产品应用8

世界模型的DeepSeek时刻!魔芯Flash World Model降本70%,跑出50FPS实时交互

魔芯科技发布全球首个超高帧率交互式世界模型 MoWorld,无需高端 GPU,实现影视画质、50 FPS 实时交互,降本 70%。其技术架构先进,产业化路径清晰,获过亿美元融资。

机器之心
7

刚刚,Fable 5全球复活!限时7天,额度砍半

Anthropic官宣Fable 5回归,7月1日至7日限时开放,顶配套餐周使用额度砍半。虽更新安全防护,多数编码任务不受影响,但新防护有误伤,且Token消耗快,还拒绝部分正常提问。其自动化率显著提升。

新智元
开源动态7

Headroom:Netflix 工程师开源的上下文压缩工具,省 token 还是烧 token?

Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。

AI工程化
产品应用7

Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦

Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。

AI科技评论
新闻资讯8

40万次Claude Code会话实锤:这才是AI时代最值钱的本事!

Anthropic用40万次Claude Code会话数据得出结论,决定AI编程成败的不是代码功底,而是对行业的理解。人决定造什么,AI决定怎么造,懂行的人能从AI榨出几倍产能。

新智元
新闻资讯7

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

Datacurve推出新基准DeepSWE,号称「零污染」,用113道原创题挑战旧编程榜单。它使GPT和Claude名次逆转,揭示旧基准验证误差大、存在作弊现象,虽有局限,但反映编程基准竞争转向抗污染和验证可信。

新智元
新闻资讯8

最新!Karpathy:Vibe Coding只是抬高了地板,真正的战场在这里

Andrej Karpathy在AI Ascent 2026上与红杉合伙人对话,分享自提出“vibe coding”一年来的变化。谈到技术转变、Software 3.0、模型“锯齿状”特征等,还区分了vibe coding和agentic engineering,指出人类需保留品味、判断力等。

AI寒武纪
产品应用8

Claude Code 最佳实践:从「能用」到「用得好」的 15 个关键技巧

GitHub热门仓库‘claude - code - best - practice’拆透Claude Code用法。本文提炼其精华,结合经验给出实操指南,涵盖上下文管理、CLAUDE.md设置、子代理等15个关键技巧,助你用好Claude Code。

AI Reading Hub
产品应用8

设计行业天塌了!Anthropic再推王炸产品Claude Design:设计稿、原型、PPT一句话搞定

Anthropic推出平台产品Claude Design,用Claude Opus 4.7模型助力设计。它能让各类用户完成视觉内容创作,有多种使用场景和便捷工作流程,还给出内部设计师使用建议。

AI寒武纪