「空间能力评估」共找到 4081 篇相关文章
AI 行业悄悄统一了一件事:Agent Skills 开放标准全解析
Agent Skills 是一套开放标准格式,超 30 家主流 AI 开发工具已采纳。它结构简洁,有精妙的三层加载机制,解决了 AI Agent 上下文窗口问题。与 MCP 解决不同层面问题,生态正快速成型。
Agent失忆怎么办,Anthropic教你做好工作交接
文章指出AI Agent跨上下文窗口执行长任务时易失败,Anthropic用Opus 4.5实验发现,问题根源是交接差。解决办法是让Agent像人类工程师一样留文档、进度和测试,拆分流程,严格规范,提升测试覆盖率。
为什么软件工程治理很重要:降低风险但不拖累速度
Sarah Wells 在哥本哈根 Goto 会议称,软件工程治理助团队决策、支持价值交付。糟糕治理会拖慢进度、增加成本。技术策略和组织技术雷达可辅助决策,还能从 DORA 能力学治理。
2025年如何学AI?如何用好AI?
文章围绕2025年学AI、用AI展开,作者黄益贺分享问答,涵盖学习指引、工具使用、产品赛道选择等多方面内容,如建议新手边用边学,对比不同工具功能,还分析了各模型和工具的特点与适用场景。
盘一盘,2017年Transformer之后,LLM领域的重要论文
本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。
Claude 4破解困扰人类4年系统bug,30年码龄程序员200小时没搞定,GPT-4.1/Gemini-2.5也做不到
30年码龄程序员4年没搞定的顽固型‘白鲸bug’,Claude Opus 4配合Code模式,用30个prompt+1次重启,几小时就破解。此前GPT - 4.1等模型都失败,凸显Claude编程与推理能力强。
OpenAI连破10道数学难题,Fable 24小时「复现」5道
这个周末,OpenAI与Anthropic两大AI巨头在数学前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数学成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。
Show me《指环王》!卡帕西强推大模型评测新基准
大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。
Claude Code惊人身世曝光!竟脱胎于安全对齐,Boris:才完成1%
Claude Code起源于Anthropic内部安全对齐项目,其发展历经波折。从2021年早期尝试,到2025年正式发布,期间突破重重技术难题。虽已改变硅谷运转方式,但核心开发者Boris称只完成1%。
当「提示词工程师」开始像制片人一样思考,Seedance 2.0 Skill OS 深度解析!
AI 视频工具圈存在模型强但使用方式单一、信息孤岛和提示词‘玄学化’问题。`seedance - 2.0` 仓库搭建‘操作系统’,将‘提示词’升级为可审计制作流程,还给出各岗位产出表和使用方式。