「声明式框架」共找到 2220 篇相关文章
Vercel 开源 json-render!短短 4 天狂揽 7500 Star,这才是 AI 生成 UI 的终极解法!
Vercel 开源的 json - render 4 天获 7500 Star,解决生成式 UI 不可控问题。采用‘AI → JSON → UI’公式,结合‘约束’与‘流式’机制,还有反向生成源码功能,介绍了快速入手办法与适用场景。
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识
Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。
高保真、多控制集成于「统一画布」,组合式图像生成新范式!
Canvas - to - Image是新型图像生成框架,将多种控制方式整合到统一画布,用户可直观操作生成高保真、多控制图像。它简化创作流程,解决了现有方法控制单一分散、交互性差的问题。
RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案
卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。
Claude Opus 4.5 × Agent Skills:从第一性原理深入剖析
文章深入剖析Claude Opus 4.5与Agent Skills,介绍了Claude Opus 4.5发布,结合Agent Skills能让模型有专业级能力。还阐述Agent Skills高级设计模式、内部架构及执行生命周期,揭示其工作机制与优势。
为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述
文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
2025年成AI智能体元年,市场规模爆发式增长,但企业部署面临‘效能黑箱’。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现公开征集起草单位和个人。
刘鹏飞组发布上下文工程2.0:人机交互的全新视角
刘鹏飞组论文《Context Engineering 2.0: The Context of Context Engineering》重新梳理上下文工程领域。它追溯其20多年历史,给出形式化定义与四阶段模型,探讨关键问题,将其从技术技巧升为系统学科,为理解人机交互提供新视角。
ICML 2026新规「避坑」指南:参会非必须、原稿将公开、互审设上限
要投 ICML 2026 顶会的需注意新规,如论文被接收作者可选择是否参会,原始投稿版本将公开,互审论文数量受限等。还介绍了投稿要求、重要日期、评审机制等内容。