「Agent 3」共找到 4458 篇相关文章
性能飙升42%!人大&字节开源10万级 SWE数据集 Scale-SWE
近期,人大和字节开源10万级软件工程数据集Scale - SWE,用首创工作流从GitHub构建真实数据。基于此微调的Qwen3 - 30A3B - Instruct模型测试表现佳,其数据相比合成数据优势明显。
AI 驱动的智能异常处置:从异常发现到根因定位
在 2025 年 QCon 全球软件开发大会(北京站)上,阿里云算法专家张颖莹分享《AI 驱动的智能异常处置:从异常发现到根因定位》。她介绍阿里云计算平台运维挑战,给出算法选型与设计思路,还提及后续平台建设规划。
智谱 GLM-4.7,Coding 开源第一,其他也很强
智谱正式发布并开源专为 Agentic Coding 打造的 GLM-4.7 模型,编程、推理、Agent 能力成绩亮眼,价格比 Claude Sonnet 4.5 更优。还推出 Coding Plan 套餐,使用方式多样。发布前几天,智谱港股招股书挂网。
AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊
图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型能找准方向,人类面对该问题也会困惑。
这个Skill太香了!Karpathy说的AI写代码的毛病,直接治好
GitHub上的开源Skill andrej - karpathy - skills受Karpathy启发,能解决AI写代码的毛病。它将Karpathy洞察提炼成四条原则改造AI Agent行为,安装简单,可自定义,能约束Agent,让开发者关注关键判断。
我们离Coding领域的「AGI时刻」还有多远?字节跳动Seed发布NL2Repo-Bench仓库级长程代码生成基准
在AI编程领域,大家认为Coding领域的AGI似乎可以实现,然而真正的项目开发要求更高。近日,字节跳动Seed等联合发布首个评估编码智能体端到端仓库生成能力的基准测试NL2Repo - Bench,还介绍了其构建、评估等情况。
智能体A2A落地华为新旗舰,鸿蒙开发者新机遇来了
华为Mate80系列、MateX7发布会上展示,搭载鸿蒙6的Mate X7实现Agent to Agent智能体协作商用落地。HarmonyOS 6重构应用连接方式,A2A协作带来效率革命,为开发者提供新机遇。
英伟达:祝贺谷歌TPU成功,但GPU领先一代
谷歌凭Nano Banana Pro、Gemini 3大获全胜,且Gemini 3用自研TPU。谷歌向客户推介TPU本地部署方案,欲抢占AI芯片算力市场。英伟达紧急发声强调自身核心地位,还砸钱拉拢大客户。
OpenAI首个GPT-5找Bug智能体:全自动读代码找漏洞写修复
OpenAI发布由GPT - 5驱动的白帽Agent——Aardvark,能在大规模代码库自动发现并修复安全漏洞。它不依赖传统技术,工作流程清晰,已开启内测。10月多家科技巨头也布局Agentic AI + 代码安全。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。