「VAE-LLM数据增强」共找到 3298 篇相关文章
MCP•RL 开源:让 AI 通过强化学习,自己学会怎么用 MCP 服务器
MCP•RL 是 Agent Reinforcement Trainer (ART) 框架一部分,能让 AI 模型通过强化学习学会高效使用 MCP 服务器,解决工具调用痛点。ART 无需标注数据、通用性强,提供便捷集成方式,项目开源。
业界对 Agent 的最大误解:它能解决所有问题
业界认为AI Agent规模应用“拐点时刻”已至,但IBM强调不必过度“神化”AI。其推出watsonx Orchestrate,还指出企业应用AI要解决数据、自动化等问题,本质是业务重构,非炫技。
OceanBase全面拥抱AI!首发PowerRAG产品,CTO杨传辉详解AI战略
OceanBase在第三届开发者大会发布面向AI的应用产品PowerRAG,CTO杨传辉解释其AI战略,即构建Data×AI能力,推动一体化数据库向一体化数据底座演进,这对行业发展有推动作用。
蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
拒稿警告,靠大模型「偷摸水论文」被堵死,ICLR最严新规来了
ICLR 2026出台大语言模型使用政策,规范作者与审稿人使用LLM做法,明确需如实披露使用情况并担责,违规将受处罚。其他顶会如NeurIPS、ICML等也有相关规定。
开源一周狂揽 35K 标星!Karpathy 开源 autoresearch:630 行代码让 AI 自动“炼丹”!
前OpenAI、特斯拉前AI总监Andrej Karpathy发布新项目autoresearch,一周揽35.6k Star。它是极简版LLM训练环境,630行代码让AI自动做研究,人类通过Prompt指导,AI自行实验。
“光顾赚钱不搞研究”,OpenAI元老级高管出现离职潮,Mark Chen紧急回应
OpenAI现元老级高管离职潮,如研究副总裁Jerry Tworek等。《金融时报》称与战略转向有关,Mark Chen反驳。内部因专注LLM撕裂,缺算力致资源集中ChatGPT,OpenAI危机四伏。
3.8K星爆款!Google「langextract」可视化溯源,信息抽取神器
Google的「langextract」在GitHub获3.8K星,是信息抽取神器。它有精准源定位、可靠结构化输出等特点,支持多种LLM,适用于各领域,文章还给出实战代码示例。
架构解耦是统一多模态模型所必须的吗?全新AIA损失:No
香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一多模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。
腾讯音乐如何基于 AutoMQ 降低 Kafka 50%+ 成本
腾讯音乐旗下产品产生海量数据,传统自建 Kafka 集群运维复杂、成本高。为此,运维团队选 AutoMQ,将成本降超 50%,提升扩缩容效率,降低运维负担,本文分享其经验。