「可验证评分机制」共找到 1673 篇相关文章
这大概是我读过关于AI大模型最全面、好读又易懂的文章了
文章从神经网络入手,介绍其概念、学习过程,进而引出大语言模型,阐述其原理、训练方法,还提及AI浪潮下基础设施及大模型使用方式,如Agent、MCP等,展现神经网络和大模型发展现状与前景。
AI Agent 总翻车?这篇综述戳破了 3 个关键误区
很多团队做AI Agent停留在‘LLM+工具’表面拼接,运行易出问题。该综述指出AI Agent是‘系统’,介绍其架构,还给出常见误区的应对方法、落地检查清单,展望应用前景。
R1一周年,DeepSeek Model 1悄然现身
2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。
Claude Code 的创始人揭秘工作流程:开 5 个智能体“玩编程游戏”,不看的程序员就落后了?
Anthropic公司Claude Code创始人Boris Cherny在社交平台分享工作流程,引发行业关注。他并行运行5个Claude智能体编程,用最大最慢模型Opus 4.5,还解决AI“健忘症”,实现重复性任务自动化。
CJA | 中国航天气动院冯亦葳、许亮等:符号回归启发的可压缩流场结构智能识别:基于局部对流特征分布的统一理论框架
目前流场结构识别方法有局限,传统经验法依赖阈值,深度学习法可解释性与泛化能力不足。本研究从流体控制方程出发,用符号回归建立统一流场结构分类框架,能准确识别复杂流动结构。
Anthropic 重新定义智能体终局: Bash Is All Agent Need!
Anthropic工程师Thariq Shihipar提出,最强大的Agent工具是Bash和文件系统,基于Unix思想构建Agent会超传统API工具。还介绍了上下文工程、Agent Loop本质等内容,认为这或是Agent终极形态。
AI Coding 长文分享:如何真正把工具用起来,从原理到实践
本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。
最新最完整的Agent Memory综述!
《Memory in the Age of AI Agents: A Survey》由多顶尖机构联合发布,对AI智能体记忆机制系统梳理。从形式、功能、动态维度厘清AI记忆本质,提出构建下一代强人工智能的蓝图。
港大开源 Paper2Slides,一条命令,把论文变成专业幻灯片!
在AI辅助办公赛道,PPT生成一直是竞争热点,但存在好看不好用、好用不准确的问题。港大开源的Paper2Slides项目,能一条命令把论文转成专业幻灯片,还能做海报,解决了AI幻觉问题。
清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能
清华团队用两个 1.5B 模型证明,用最基础的 RL 配方可达到小模型数学推理能力 SOTA。单阶段训练加固定超参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。