「核心能力标准」共找到 4696 篇相关文章
智谱GLM-5强调的Agentic Engineering能力是什么?|甲子光年
智谱上线并开源GLM - 5,在Coding与Agent能力上达开源SOTA,刺激股价上涨。它验证了Agentic Engineering可行性,提升能力阈值,但成本阈值也更显性,未来软件工程或分层发展。
Claude Code迎来大更新:Agent能力增强
Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。
装上这个Skill后,Claude Code联网能力直接拉满
Web Access 是给 Claude Code 用的 Skill,装上后 Agent 联网能力大幅提升。它解决了 Claude Code 原有联网工具的问题,有联网工具自动选择、CDP 浏览器操作等能力,还介绍了安装方式和设计哲学。
Anthropic 定义了标准,我们造了库:为什么 2026 是 Agent Skills 元年
2025 年 12 月 18 日,Anthropic 将 Agent Skills 发布为跨平台开放标准,终结了 Agent 开发混乱。特赞团队推出 `skill0` 响应标准,其诞生源于企业业务需求,2026 年 Agent 开发将质变。
清华&Qwen最新论文实证: VLM 智商与机器人操控能力“零相关”
清华和 Qwen 最新论文《VLM4VLA: Revisiting Vision - Language Models in Vision - Language - Action Models》测试 24 个 VLM 模型,构建极简 VLM4VLA 测试,发现 VLM 通用能力与机器人操控能力‘零相关’,还揭示视觉编码器短板。
苹果炮轰AI推理遭打脸,GitHub大佬神怒怼!复杂任务≠推理能力
苹果发表论文指出推理大模型存在重大缺陷,相关解读在社交平台广泛传播。但GitHub高级工程师Sean Goedecke对论文持保留态度,认为谜题不是评估推理能力的好试验场,模型放弃不代表无推理能力。
即将截止征集 | 全国首部AI数据标注合规标准,欢迎加入!
由中国电子商会归口、智合标准中心组织、中移互联网牵头起草的全国首部AI数据标注合规标准《面向人工智能的数据标注合规指南》,历时7个月,经多轮研讨,即将修订报批,仍有参编机会。
无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%
当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人
2025年成AI智能体元年,国务院提出目标,市场规模爆发增长。但企业部署面临“效能黑箱”,智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现公开征集起草单位和个人。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
AI智能体正从辅助向自主决策进化,但企业因缺乏评估规范,面临选型、验收、优化难题。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,公开征集起草单位和个人。