「agent能力」共找到 5258 篇相关文章
API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验
API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。
智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答
5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力。
和Anthropic CEO一起发过Nature,他用Claude Code复活三年烂尾代码
华盛顿大学首席开发者Brendan MacLean用Claude Code复活三年烂尾代码。他像带实习生一样带Claude,构建上下文让其理解代码库。同一周OpenAI开源Symphony,实现任务自动派Agent。二者路线不同但目的相同,都在探索让AI融入工程流程。
藏师傅 Kimi K2 Thinking 首测!教你用 Kimi 编程全家桶
本文首发测评藏师傅 Kimi K2 Thinking,介绍 Kimi 编程全家桶。K2 Thinking 有 Agent 化等多方面升级,还推出 Kimi CLI 工具与 KFC 套餐。作者展示全家桶使用方法并多维度测试,肯定其表现,赞 Kimi 战略清醒务实有远见。
每周2亿年轻人用ChatGPT,却连高手的零头都没用出来
全球超2亿18 - 24岁年轻人用ChatGPT,高阶用户调用能力仅为超级用户1% - 10%。OpenAI推出三款教育插件,分别针对K - 12老师、大学老师和大学生,还搭建教育闭环,不过教学权仍在教师、学校和政府手中。
一夜200万阅读,OpenAI神同步!这项测评框架让全球顶尖LLM全翻车
中国团队领衔全球24所高校机构发布评测LLMs for Science能力的论文,一夜阅读近200万,同一时间OpenAI也发文指出现有评测标准在AI for Science领域失灵。论文推出评测体系SDE,发现主流大模型在科学发现上短板明显。
AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA
MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。
开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4
上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。
AI × 老旧系统:Vibe Coding 构建 AI 迁移工具,实现 10x 端到端智能迁移
文章指出老旧系统现代化复杂且需大量人工,AI 编程工具和 Vibe Coding 带来新可能。介绍 6R 策略、绞杀模式等迁移方法,还阐述 AI 在系统分析评估、代码转换等方面的应用,最终目标是打造闭环 AI 迁移 Agent。
字节押注AI Coding:百万月活的TRAE,如何改写开发者生态?|甲子光年
字节跳动在火山引擎Force 2025原动力大会主推自研AI编程产品TRAE,其月活超百万,内部80%工程师在用。AI Coding能提升大模型能力,助字节逼近AGI。TRAE更新功能,未来或成独立开发超级个体。