「技能空间」共找到 814 篇相关文章
提示工程实战指南:从Zero-Shot到Graph Prompting,7大核心技术全解析
随着大型语言模型发展,提示工程成关键技能。文章介绍零样本提示、少样本提示等七种提示优化模式,分析适用场景、优缺点,还给出示例,最后总结各技术适用场景及最佳实践。
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。
扣子 Agent 创作者榜单 - 2025.4
2025 年大模型和 Agent 渐入大众视野,虽大家对 Agent 理解有别,但它落地效果和想象空间大。扣子用户达百万级,此次发布最新创作者榜单,后续还将发相关内容。
5w颗星!前Google工程师为Agent打造的设计系统
Anthropic的frontend - design是Claude首个广泛使用设计技能,Impeccable由此起步并扩充功能。它有一次设置流程、23条命令、59条确定性检测规则等,还给出反模式,介绍多种安装方式及使用方法。
让 AI 自己做增长:基于OPC和Harness思想的自主增长系统探索
文章围绕让AI自主做增长,基于OPC和Harness思想构建自主增长系统展开。介绍了系统背景、做法、多Agent架构落地方案,还提及踩坑问题、解决方案及对未来的思考,如完善数据集、探索OPC + AI Agent模式。
Kubernetes v1.36 发布:安全默认配置强化,AI 工作负载支持日趋成熟
Kubernetes发布1.36版本,代号Haru,含70项增强功能。聚焦安全加固、AI和机器学习负载及API扩展性。安全功能多达GA,AI负载适配需求,还引入新功能,同时移除部分旧功能,Ingress NGINX正式退役。
VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解与具身交互
华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。
ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御
合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。
上交大54页综述讲透Agent认知外部化的演进之路
上海交大联合多机构提交综述论文,首次以「外部化」为统一视角,梳理了LLM Agent的记忆、技能、协议与Harness工程四大支柱。指出Agent实际进展取决于外部认知基础设施,而非模型能力提升。
用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源
browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成图让LLM理解视频,有完整流水线和设计原则,还给出使用方法。