「政策治理」共找到 246 篇相关文章
OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%
USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。
Gartner:生成式AI不会取代软件工程师
全球著名咨询调查机构Gartner官网发布专访,分析师Haritha Khandabattu认为生成式AI不会取代软件工程师,其可提高生产力。还谈及在招聘人才方面的变化及领导者助团队成功的关键措施。
ICLR史无前例!中国团队站上C位,全球AI顶会首次为它设专场
ICLR宣布由阿里妈妈牵头的「AI for Mechanism Design and Strategic Decision Making」专题研讨会通过评审,这是其首次设聚焦「机制设计与决策智能」的Workshop,众多大咖参与,连接学术与工业。
硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围
2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力。
企业级 AI Agent:彻底说清 MCP、CLI、Skills,如何定位、该怎么选、最佳实践。
文章解读了 MCP、CLI、Skills 三者定位、组成与工作层次,介绍工具选择方法,强调组合应用以发挥企业 Agent 最大效能,还指出 MCP、CLI、Skills 使用误区及 PTC 应用模式等。
桌面版Codex的好日子,OpenAI两年前的宫斗剧内幕被曝光,并非路线之争!
在OpenAI发布桌面版Codex时,微软CTO内部邮件曝光2023年11月OpenAI政变内幕。冲突核心是资源争夺和个人地位之争,包括GPU资源分配矛盾、Ilya与Sam个人矛盾,还暴露出董事会运营经验不足等问题。
芯片初创公司的斩杀线
IC设计语境里,初创公司有生死线和温饱线“斩杀线”,过不了红线可能出局。融资阶段投资机构设对赌协议,形成创始人个人“生死线”,创业团队需布好三道防火墙避免陷阱。
不用人类手写训练框架了!AI自己写代码,训出1B端侧「小钢炮」
5月25日,面壁开源端侧文本基座大模型MiniCPM5 - 1B,主打低成本部署等。它由AI编写的ForgeTrain框架参与预训练,效果与英伟达Megatron对齐且速度快10%。该模型在榜单表现优,应用边界广,部署门槛低。
从业务场景到组织体系,“龙虾” 如何走进企业
“龙虾”火了后,从个人工具走向企业业务场景时问题不同。阿里云“虾友会”传递其进入企业的逻辑,包括解决业务场景接入,经历身份权限、岗位能力、持续运营三重门,回归运行时,最终送进企业工作流。
Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!
Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。