claude-init」共找到 1392 篇相关文章

推荐文章8

Anthropic揭秘Agent长线开发架构:引入GAN机制,Claude自主撸出全栈应用

Anthropic公开前端设计和自主软件工程最新突破,为让Claude构建完整应用,从GAN汲取灵感设计多智能体协同架构。介绍架构实践、解决的问题及应用效果,还探讨架构简化和设计规律。

AI寒武纪
产品应用8

Claude官方即将推出Chrome浏览器插件,可能....其它所有的AI浏览器插件都会死。

Claude官方即将推出Chrome浏览器插件,现正进行小范围测试。它功能强大,能在侧边栏操作页面,还能处理日程、邮件等工作。相比多数插件,它安全性高,或让仅能总结摘要的插件被淘汰。

开源AI项目落地
产品应用8

4个月11万用户、Claude Code成了,Dogfooding该被AI公司重视起来了

Dogfooding(内部试用)应被AI创业公司重视。Anthropic推出的Claude Code源于内部工具孵化,经内部使用和场景验证后发布,四个多月获11万开发者用户,其成功说明深度内部试用是竞争优势。

Founder Park
开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
开源动态7

12K Star 的 claude-seo:免费 SEO 审计能替掉哪些付费工具

2026年2月底GitHub上claude - seo仓库有3500 star,五个月后达12.3K star。该项目作者一人开发,能给站点做SEO审计。它把判断层抽出开源,审计后可直接改代码。不过也有动态渲染弱等问题。

AI Reading Hub
产品应用7

Claude/Codex又爆猛烧钱bug,随时准备烧空你的额度,官方躺平不修复。

Claude、Codex这两个用户量大的Agent产品,存在官方不修复的烧钱bug。往会话贴的图片以base64存于session历史,反复重发计费,严重时会话废掉,官方此前也对类似问题不作为。

探索AGI
算法论文8

超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发

斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。

量子位
新闻资讯8

“最强编码模型”上线,Claude 核心工程师独家爆料:年底可全天候工作,DeepSeek不算前沿

Anthropic 开发者大会发布 Claude 4 ,含 Opus 4 和 Sonnet 4 型号,在基准测试表现出色。核心工程师预测年底软件工程智能体能力,谈 RL 及 DeepSeek,还提到模型自我意识、推理计算瓶颈等问题。

InfoQ
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
算法论文7

Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了

随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。

机器之心