「Claude Research」共找到 1505 篇相关文章
Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude
Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为大模型要规模化,断言大模型训练进入第三阶段。
比肩Claude Opus:阶跃星辰最强模型Step 3.5 Flash发布
阶跃星辰发布最强模型 Step 3.5 Flash,参数强大,性能与前沿顶级大模型并驾齐驱。其架构平衡算力与智力,有独特注意力布局;基础设施保障训练稳定;强化学习激发智能体潜能;评测数据显示战斗力强,未来还将持续优化。
claude code也过气了?opencode+插件彻底火了~
opencode是开源CLI coding Agent,其与oh - my - opencode组合能让订阅的多个模型组队干活。还兼容claudecode,后台agent并行,lsp工具全开,有“ultrawork”魔法词,适合常切换用模型的人。
大神周末开源省token野路子,claude fable5账单砍掉6成
外网大神周末开源插件,将模型上下文等渲染成图片,可让账单降低59% - 70%。原理是图片token只与像素尺寸有关。此前因模型识图能力差难落地,fable5证明其极限省钱且效果保留。
Claude 和 Manus 还要人工搭框架?小米直接让 Agent 自我进化
6月12日小米Darwin Agent Team发布论文《HarnessX》,用“系统自进化”终结Harness人工调优时代,带来性能跃升。其让Harness成为“一等公民”,有可组合等特质,还能与模型协同进化,虽有局限但成热门方向。
Auto Research时代,AI Scientist的第一场药企实习考验|甲子光年
AI Scientist从大模型做题家进化为自动化科研助手,但从demo到应用面临买单难题。Phylo等团队构建BiomniBench评估框架,让AI做药企真实数据分析,结果显示AI表现超人类实习生,且有速度和成本优势,但也存在偏科问题。
OpenAI急眼了!四页密信怒撕Claude,80亿营收全掺水
OpenAI首席营收官Denise Dresser发四页内部备忘录,向员工发出「决战动员令」,要从「卖产品」转向「做平台」。备忘录火力全开,抨击Anthropic,还急着与微软划清界限,将亚马逊视为重要伙伴。此外,还曝光了接下来90天要做的五件事。
扩散模型+自进化:这篇论文让Deep Researcher错误率直降70%
论文提出测试时扩散深度研究代理(TTD-DR),将报告生成建模为扩散过程,有组件自进化机制和动态闭环设计。实验显示其在多领域研究任务超现有方案,为AI研究助手落地提供新范式。
谷歌杀疯!百万token神器免费开源,Claude和Codex都顶不住了?
谷歌开源免费AI编程工具Gemini CLI,权限拉满,有百万token上下文、千次调用额度,打通VS Code与终端。它与OpenAI、Anthropic竞争,功能不止写代码,还支持多通用任务,谷歌这次来真的!
关于 Multi-Agent 到底该不该做,Claude 和 Devin 吵起来了
有两篇多智能体文章引发热议。Anthropic分享多智能体研究系统构建经验,指出适合特定任务;Cognition认为当下AI Coding暂不适用多智能体。文章还介绍多智能体架构、提示词原则等内容。