「长时程Agent」共找到 3229 篇相关文章
DeepSeek如何实现5000亿估值?外媒曝其API毛利率高达82.9%
据外媒报道,DeepSeek今年前七个月营收约4.75亿,较2025年全年增长近10倍,净亏损收窄,综合毛利率44.6%,API业务毛利率达82.9%。它正磋商500亿二轮融资,筹备明年沪上市,靠优化基建降本,低价策略吸客。
DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分
DeepSeek首个多模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,多模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
Claude Code没有“魔法”
资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型可放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。
Mimo Code 爆火:我们挖开源代码,找到小米 AI 的真创新
6月11日小米MiMo团队开源MiMo Code项目,定位终端编程Agent。它基于anomalyco/opencode,虽有创新但引发争议,有人肯定工程设计,也有人质疑fork行为和运营节奏,本文还探讨了Harness方向与开源意义。
刚刚,DeepSeek陈德里与两个AI,合写了一篇论文
DeepSeek研究员陈德里与DeepSeek-V4-Pro、GPT - Image2合写论文《From Copilots to Colleagues: A Survey of Autonomous Research Agents》。文章是兴趣驱动的尝试,分析自主科研智能体,提出自主等级分类、架构模式分析及未解难题。
对话 Lucius 赵赫:AI 员工的本质,是一份有 SLA 的劳动合同
这是对Lucius创始人赵赫的访谈。他表示Lucius做的是企业的Context Layer,提供有SLA的AI员工服务。目前服务三十余家企业,交付结果而非提效,还探讨了AI员工角色、与人类关系、技术架构等内容。
名师一定出高徒?清华团队最新揭秘:别再迷信大模型蒸馏的「免费午餐」
当下大模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能无提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。
8岁小孩哥「聊出」操作系统,一部手机、几句话,原生App直接生成
8岁小孩扑满借助秒哒做出「操作系统」雏形,百度2026 Create大会上秒哒3.0迎重要升级,从移动端、原生App、企业版、Agent能力四个维度重构,降低开发门槛,提升能力至生产级。
甲小姐对话郝景芳:从北京折叠到AI折叠 | 甲子光年
这是甲小姐与郝景芳的对话,探讨AI对工作、社会、教育等方面的影响。郝景芳分享创业经历,谈AI编程体验,分析AI时代公司组织、就业、社会阶层变化,还探讨AI应用、素养普及、人类角色等问题,表达对人性和社会发展的看法。