关键表征微调」共找到 1367 篇相关文章

产品应用8

这篇超有用!手把手教你搭建 AI 产品 Evals

文章指出AI下半场模型评估比训练更重要,做好Evals是当下AI产品开发刚需。介绍了Evals重要性、三种方法、通用评估标准等,还教你从零构建Evals及设计注意事项,助你快速上手评估。

Founder Park
新闻资讯7

2025 AI Agent 发展现状与六大趋势

近半年,Agentic AI 创新加快,推动产品落地与商业化。2025 年市场格局显现,有 Agentic RAG、Voice Agents 等六大关键趋势,各有定义和应用场景,不少公司已采用相关技术。

特工宇宙
推荐文章8

24个Agent工作流框架用哪个? 11个维度全面评测

LLM发展推动自然语言理解进步,国产LLM密集发布。文章从功能能力和架构特性两维度,对24个智能体工作流框架全面评测,给出关键结论,还提及优化策略、应用领域等。

PaperAgent
新闻资讯7

电商上演「魔法对轰」:卖家用AI假图骗下单,买家拿AI烂水果骗退款

电商领域,卖家用AI假图骗下单,买家拿AI假图骗退款,双方上演“魔法对轰”。单一证据易伪造,平台探索技术和策略组合,建立统一数字内容标准或成破局关键

机器之心
7

人类选手苦战10小时获得世界编程冠军,OpenAI获得亚军,但这可能是最后一次了

在AtCoder启发式编程世界杯总决赛,人类选手Psyho苦战10小时击败OpenAI的AHC模型夺冠。赛事专注优化问题,比赛过程跌宕起伏,也证明了AHC具备持续性推理等关键能力。

AI寒武纪
算法论文8

AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」

Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
算法论文8

LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25

最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。

新智元
推荐文章7

Karpathy:我不是要造新词,是「上下文工程」对 Agent 来说太重要了

Andrej Karpathy 认同Shopify CEO关于「上下文工程」的观点。它指为大语言模型提供恰当信息和工具,比提示词工程更重要。文章介绍其概念、与提示词工程区别,及写入、筛选等落地策略。

Founder Park
开源动态8

集GraphRAG 和 DeepSearch于一体的智能问答系统graph-rag-agent

本项目结合GraphRAG与私域Deep Search,实现可解释、可推理的智能问答系统。亮点有从零复现GraphRAG、创新融合DeepSearch等,具备多模块功能,还有简单演示,地址https://github.com/1517005260/graph-rag-agent/blob/master/readme.md。

GitHubStore
新闻资讯8

李飞飞自曝详细创业经历:五年前因眼睛受伤,坚定要做世界模型

在a16z播客节目中,“AI教母”李飞飞讲述创业经历。五年前眼伤失立体视觉,让她意识到其对空间交互的决定性作用。她认为真正通用智能需理解物理世界,与Martin Casado一拍即合创立World Labs,加速世界模型突破。

量子位