「生产级Agent」共找到 3663 篇相关文章
刚刚,全球AI百强榜发布!ChatGPT稳坐第一,DeepSeek第三,前50有22个来自中国
a16z发布「全球Top100消费级GenAI应用榜单」,显示AI竞争格局渐稳,进入多极化阶段。中国多款产品跻身前十,谷歌携四款产品入榜,ChatGPT居首,Grok紧追,氛围编程崛起,还有14家‘全明星’公司从未缺席。
北大校友孙之清C位出镜,小扎看OpenAI直播夺人!1亿刀薪酬光速被签
CoT之父Jason Wei离职后,又一华人科学家孙之清入职Meta。他曾在OpenAI与奥特曼同框直播,此前深度参与o3等项目,还带头做「ChatGPT Agent」技术实现。加上Jason Wei等,三人都加入Meta。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
6月10日美团推出首款AI Coding Agent产品NoCode。美团基础研发平台工程效率负责人程大同在访谈中解答诸多问题,如模型性能优化、产品竞争力、用户使用难点等,还提及产品未来规划和对行业发展的看法。
从烧光现金、裁掉一半员工,到 ARR 9 个月破亿:Replit用“全栈平台”反杀Cursor,赌赢“每层都赚钱”模式
2024年初到2025年9个月内,Replit年度经常性收入从不到1000万美元破亿。其增长靠系统性战略,以AI编程代理获客,后端基础设施变现。它反映AI编程工具从编辑器进化为平台的趋势。
OpenAI 4 名王牌研究员“叛变”,Meta 上亿美元的签约奖金终于花出去了
近日,Meta招募四名前OpenAI研究人员加入超级智能实验室,此前其曾试图以1亿美元挖角。Meta组建该实验室是因Llama 4 Behemoth性能问题。此外,Meta还从多渠道揽才,今年将投650亿美元支持AI项目。
打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年
红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。
MinerU又开源了!这次专治OCR跨页失忆症
文档解析领域,MinerU团队开源了专门给OCR结果做“后处理”的4B小模型MinerU - Popo。它能把碎成一页一页的OCR结果重新拼成文档级结构,解决了当前OCR跨页逻辑断裂问题,且效果和成本优势突出。
Meta新模型逼平Fable 5,小扎:开源且便宜到你懒得算账
Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。小扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。
国际PC巨头入局,Violoop押注个人主权AI|甲子光年
Violoop获亿元级融资,产品计划9月16日众筹。它想让AI设备随使用更懂用户,提出“个人主权AI”,即个人掌握经验与改进能力。研发聚焦让AI理解人,设置主权边界,有三层自进化路径,还探索多终端应用。
一个Skill让DeepSeek V4 Pro超越Fable 5?热门插件被锤了
前两天J-Space凭夸张测试结果刷屏,宣称一份Skill接入Agent环境,能让V4 Pro在多基准大幅提升,部分成绩超Fable 5。但社区复测结果相反,作者未公开完整评测记录,还删质疑帖,引发公开打假。