M3 - Agent」共找到 4520 篇相关文章

新闻资讯7

GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭

最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。

新智元
新闻资讯8

前端危!Gemini 3内测结果获网友一致好评,“有史以来最强前端开发模型”

谷歌下一代旗舰模型Gemini 3未发布便走红,内测结果显示它擅长前端、SVG矢量图生成,多模态能力更强。网友实测其在编程、绘图等方面表现出色,疑似谷歌内部文件显示发布时间为10月22日。

量子位
开源动态7

这个51K星标的开源神器,让任何Agent都能一键切换所有模型。

作者分享开源工具CC Switch,它能让Agent产品一键切换模型,已获50k星标。该工具全平台可用,可预填配置,还具备用量追踪、使用统计、故障转移等实用功能。

数字生命卡兹克
新闻资讯7

全球3D-HUD唯一量产背后:一家中国供应商的十年长征|甲子光年

长安马自达EZ - 60搭载的全球首款量产裸眼3D - HUD,核心光学零部件及算法来自中国炽云科技。该公司用十年将战机显示技术民用化,解决诸多技术问题,通过转型合作实现量产,还参与国标起草。

甲子光年
推荐文章8

破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附零基础实战

随着LLM驱动的Agent从学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。

腾讯技术工程
推荐文章7

深度解析LLM Wiki / Obsidian-Wiki / GBrain:Agent时代知识的“自组织”与“自进化”

文章深度解析LLM Wiki、Obsidian - Wiki和GBrain项目,探讨Agent时代知识的“自组织”与“自进化”。指出传统知识管理有短板,而这些项目通过不同方式解决知识结构化、沉淀和更新问题,各有优劣。

阿里云开发者
新闻资讯8

种子轮10.3亿美元!谢赛宁加入,LeCun的世界模型公司太吸金了

图灵奖得主 Yann LeCun 创办的先进机器智能实验室(AMI)官宣起航,完成 10.3 亿美元种子轮融资,估值 35 亿美元,谢赛宁加盟。AMI 目标是做理解现实世界的 AI,想走世界模型路线。

机器之心
产品应用7

“豆包工作”已经是我的主力 Agent:查数据、做内容、协作,一条链全接住

这几天豆包工作推出独立应用,作者用两天后将其作为主力 Agent。它把模型能力和工具生态组合成工作系统,能拿齐信息、加工材料,产物可交下一步,还能跨端接力。

AI产品自由
产品应用8

谷歌Genie3全网玩疯!画质飞跃720P,网友造出西幻RPG游戏

谷歌世界模型Genie3发布仅7个多月就有巨大进化,画质达720P,体验时间拉长,世界类型丰富。它玩法多样,能体验极限运动、亲近自然、穿越时空等,网友还用它造西幻RPG游戏。

量子位
开源动态7

Karpathy刚刚敲响警钟:大模型的“终极之战”打响!Agent大军即将全面接管研发

Andrej Karpathy发布新项目autoresearch,人改提示词,AI改训练代码。经约2天微调,找到约20个降低验证损失的修改,提升排行榜成绩。Agent还发现多项重要改进点,未来前沿LLM实验室或走此路。

AI寒武纪