「开发项目」共找到 2561 篇相关文章
Anthropic 最新博客:构建 AI Agent 评估体系完整指南
Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
谷歌 Gemini API 负责人自曝:用竞品Claude Code 1小时复现自己团队一年成果,工程师圈炸了!
谷歌主管工程师 Jaana Dogan 称,用竞品 Claude Code 一小时就生成了接近自己团队一年成果的系统。她公开评价引发争议,也让大家思考‘一年工程 vs 一小时生成’背后被压缩的是什么。
AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效率,Token成本失控后上下文工程成胜负手
本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。
Manus 产品立项初期会议纪要
该文是 Manus 产品立项初期会议纪要,从核心定位到技术架构、用户体验、人机协作等多方面深入探讨,为项目明确战略、技术、产品层面核心原则,开启重新定义智能体之旅。
深度之赌:从卧室到上帝机器
文章讲述现代AI秘史,从Jeff Dean本科研究神经网络失误,到Google Brain诞生;还有Hinton等深度学习先驱经历,如Hinton当实习生、AlexNet诞生等,也提及Google发展及未先发ChatGPT原因。
3.9K Star!Antigravity 火了,但更狠的是这个配套工具!
2025年或成Vibe Coding爆发年,Google推出的Antigravity很火。但开源大神开发的Antigravity Tools更厉害,它是中间件,能将Antigravity模型转成“标准API”,有多种功能,适合Vibe Coding重度用户。
7000亿豪赌,扎克伯格买了众叛亲离
为拿下AI船票,扎克伯格让Meta猛踩油门,投入数百亿参与竞赛,还多次重组AI部门。但他的强硬作风使Meta内部混乱,老将出走,新人不满。Meta虽有新模型计划,可商业模式不明,还面临伦理风险。
苹果光速撤回RLAX论文:用了谷歌TPU和阿里Qwen,作者中还有庞若鸣
苹果一篇新论文在 arXiv 公开后匆匆撤稿。该论文揭示基于 TPU 的可扩展 RL 框架 RLAX,用了谷歌 TPU、亚马逊云及阿里 Qwen 模型,还介绍其架构、策略支持等,实验结果亮眼,也分享 Debug 过程。
这款拿下 10k+ Star 的开源 LLM DevOps 平台,如何帮企业“批量孵化”AI 应用?——BISHENG 深度上手
BISHENG 是面向企业级场景的开源 LLM 应用 DevOps 平台,支持 GenAI 工作流等完整能力,已在众多头部组织落地。它围绕企业痛点搭建,有灵思 Agent、可视化工作流编排等亮点,适用于多场景。