有监督微调」共找到 6435 篇相关文章

新闻资讯7

五源、陆奇投资,Humanify 97 年创始人专访:给 AI 做一套「情商」的认知 OS

Humanify宣布完成数千万元种子轮融资,由五源资本领投,奇绩创坛跟投。创始人易和阳认为,拥类人认知与自主意识是下一代AI产品核心体验。该公司想打造“情商”的AI OS,让AI更像人。

Founder Park
推荐文章7

从“铁三角”到“六”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版

在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代。

InfoQ
推荐文章8

Agent 一年半开发复盘:大家对 Agent 的理解错位,效的「认知流程」很关键

本文是作者对一年半AI开发过程的复盘,指出大家对Agent理解错位,强调效「认知流程」的关键作用。通过高考、学霸成长等例子阐述Agent核心,对比Chatbot与Agent,还从理论视角解释其效性,最后点明开发者角色转变及面临的挑战与前沿探索方向。

Founder Park
产品应用7

人生教练团Agent v2.0!给你省下万元咨询费(内详细教程)

作者打造“人生教练Agent 2.0”,将马斯克、查理·芒格等大神“塞进”电脑。它AI主持人,能根据问题召集合适导师。还介绍使用流程,灵感源于AIasMe等,后续会教加记忆功能。

AI 产品自由
新闻资讯7

上周 GPT 和 Codex 各一个发布,很多人没注意吗?可以解锁 Codex 百万上下文了

最近基模发布多,OpenAI 俩更新被低估忽略。一是 GPT - 5.6 Sol 的 Ultrafast 模式,输出最高达每秒 750 Token,先向少量 API 客户开放;二是 Codex 为其开放百万上下文能力,不过大窗口代价。

MacTalk
新闻资讯7

“VLA和世界模型都不是终局,会物理世界独的模型” | 蚂蚁灵波沈宇军@AIGC2026

在2026中国AIGC产业峰会,蚂蚁灵波沈宇军与李根深度对话。沈宇军指出大模型踩中互联网数据红利,但机器人数据空白。他认为VLA和世界模型非具身智能终局,未来会物理世界独的模型。

量子位
开源动态8

我去,真牛!Coze Studio 开源版究竟多火?看 GitHub 最新 1.4k star 人气飙升!

Coze Studio是低代码、可视化的AI Agent开发平台,Apache‑2.0开源许可,降低使用门槛。它能解决非专业开发者、企业等构建智能对话助手的痛点,核心功能亮点多,应用场景广,在国产AI Agent开发生态潜力大。

小华同学ai
开源动态8

5.9K Star!告别 AI 画图的“廉价感”,这个开源项目让你的图表高级又品味!

技术写作者兼产品设计师Cathryn Lavery因不满Claude画图效果,开发开源项目diagram - design。它是Claude Code的技能插件,输出自包含HTML文件,多种图表类型、品牌定制等亮点,解决AI画图审美痛点。

开源星探
算法论文8

3D生成告别「穿模」噩梦!VASTx清华将蒙皮权重Token化,统一生成骨骼与权重,GRPO微调形变平滑

3D模型生成容易,让它“动起来”难,传统AI蒙皮算法局限。SkinTokens研究将蒙皮权重离散化,构建TokenRig框架,引入GRPO算法,提升了AI自动绑定精度和泛化能力,助力3D动画自动生产。

量子位
推荐文章7

直播预约 | 如何缓解LLM-as-a-Judge的潜在偏好?UDA:一种无需人工标注的无监督去偏对齐框架

论文针对不同大模型对同一组大模型回答打分差异大等问题,提出无需人工标注、模型无关、即插即用的UDA框架,以无监督方式动态调整Elo评分,实验表明该方法能降低打分标准差、提升与人类评分相关系数。

深度学习自然语言处理