有监督微调」共找到 6441 篇相关文章

算法论文8

Relink:为GraphRAG动态构建证据图

大语言模型在开放域问答中‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现方法缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计启示。

PaperAgent
8

【万字长文】Claude Skills完全指南:从概念到实战

这是万字Claude Skills指南,从概念到实战。介绍了Skills是模块化能力包,渐进式披露设计,对比了与MCP、Subagent区别,阐述其优势。还讲了创建、设计、使用方法及分类体系,提示安全风险并推荐资源。

花叔
算法论文8

不用递归自动微分,也能稳定计算高阶 PDE 导数? Mollifier Layers 如何改造 PDE 反问题学习

本文介绍《Mollifier Layers: Enabling Efficient High-Order Derivatives in Inverse PDE Learning》,指出传统PINN递归自动微分计算高阶PDE导数瓶颈,Mollifier Layers用解析卷积替代,实验显示其在精度、效率上优势,也核选择等局限。

力学与人工智能
新闻资讯7

图解GPT-OSS:架构、消息格式与推理机制等

OpenAI发布首个开源大模型GPT-OSS,虽性能无惊喜,但设计思路意思。其架构是经典延续,消息格式巧思,支持三档推理模式,分词器小进步,这些设计在实际应用和理论上一定价值。

AI工程化
推荐文章8

为什么 Agent Memory需要 AML:看 AML “变量控制”的工程设计

传统 Agent 记忆评测水分,近日放榜的 Agent Memory Leaderboard (AML) 通过严格控制变量构建盲测管线。文章从技术架构深拆其工程细节,还分析了首期榜单,指出其重构评估变量的价值。

AI工程化
新闻资讯7

咖啡机变聪明后,我连咖啡都喝不上了

一位科技记者用升级到Alexa Plus的博世咖啡机煮咖啡遭拒,社区也诸多类似吐槽。生成式AI助手虽能力提升,但因LLM随机性,在控制场景易翻车,新旧技术切换引发混乱,边界待明确。

机器之心
7

Google发布"Nano Banana"图像生成模型,号称全球第一

Google推出新图像生成和编辑功能,社区称其为‘Nano Banana’,号称‘世界第一’且免费开放。它风格转换、背景编辑等亮点,用户反馈整体积极,但也存在API限制等问题,与对手差距也优势。

AI工程化
新闻资讯7

OpenAI新模型Day0就被嫌弃!排名拉垮,不如一月底发布的国产模型

OpenAI推出GPT - 5.4 mini和nano模型,主打快速经济,针对编程等优化。但评测中GPT - 5.4 mini排名不佳,不如国产Kimi 2.5,且价格对比争议。不过与自家旧版比提升,网友测试亮点。

量子位
推荐文章7

Kotlin Multiplatform 评估:跨平台开发中的优势与权衡

文章评估了 Kotlin Multiplatform(KMP)在跨平台开发中的优劣势。KMP 可共享代码,编译成原生代码获出色性能,保留原生 UI 选项。虽生态小、学习曲线等问题,但 Netflix 等大公司已用,未来潜力大。

InfoQ
新闻资讯7

谷歌新版Gemini马甲被扒! LMArena实测:唯一能看懂表的AI, GPT-5乱答

谷歌Gemini 3.0疑似上线LMArena,其Pro和Flash马甲被扒。实测中,Gemini 3 Pro能精确看表,GPT - 5等表现不佳;SVG测试提升但也不足;还能作曲。不过评测方式老套,希望新花样。

新智元