有监督微调」共找到 6441 篇相关文章

产品应用7

腾讯悄悄上线了“Claude Code”,居然还支持微信登录。

腾讯悄悄上线CodeBuddy Code(Claude Code),定位为AI CLI,能在命令行完成编程任务。作者测试用其开发MCP服务,速度快且功能全,还介绍使用方法,不过产品稳定性问题,仍潜力。

数字生命卡兹克
算法论文7

OpenAI新幻觉论文惹争议!GPT-5拉胯是测试基准问题??

OpenAI新论文《语言模型为何会产生幻觉?》提出,模型幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。

量子位
推荐文章8

把 UI 生成接进流水线:基于半监督评测体系的 UI 自动化生产实践

本文来自蚂蚁集团黄兆嵩在 QCon 2026 的演讲,探讨生成式 UI 技术重塑生产方式。提出系列工程实践,包括高质量生成、LUI 场景应用及质量监控迭代,让前端生产自动运转、用户体验随需而变。

InfoQ
开源动态7

号称视频编辑领域的开源nano banana来了,用文字就能改视频

DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,身份保持和动态适配亮点,多个版本,应用场景广。

AI工程化
7

AI 领域最''不务正业''的团队,可能做了一件最正确的事

马卡龙是一款主打帮助用户更好生活的个人智能体,深度记忆和生成定制化生活场景小应用两大核心特点。它区别于生产力智能体,技术积累,基础聊天免费,开发小应用收费。

AI产品黄叔
算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
开源动态8

告别 AI 流量焦虑!这款开源神器让你的品牌成为 AI 的「标准答案」

市面上 GEO 工具大多是 SaaS 订阅制,收费高、数据不透明等问题。开源项目 GeoLook 是 GEO 实施平台,实现监测到交付闭环,数据主权、适配中文市场等亮点,还给出快速上手步骤。

开源星探
新闻资讯7

SpAItial发布超逼真3D空间基础模型

德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在多领域革新可能,虽竞争,但未来望推动AI三维突破。

AIGC开放社区
算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态长文档视觉问答常见于科研论文等场景,现技术路线大视觉 - 语言模型直接端到端和检索增强生成,但各缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
开源动态8

四大顶尖模型对决!6000 字测评带你看Deepseek R1多强

昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。

歸藏的AI工具箱