AI训练数据」共找到 11842 篇相关文章

算法论文7

在Think中边搜索边调整的搜索增强Reasoning方法

LLM虽知识丰富,但无法掌握训练数据外的信息,传统检索增强生成方法有缺陷。AutoRefine提出“先筛选,再回答”理念,用强化学习训练,实验显示在多方面碾压传统方法,未来或改变知识密集型任务解决方式。

深度学习自然语言处理
新闻资讯7

世界模型混战,Momenta率先冲刺IPO

当下世界模型是AI领域热门且混乱的概念,主流路线有四类。Momenta的R7世界模型已量产,其CEO定位公司为物理AI基座模型构建者。Momenta率先冲刺IPO,商业模式正转型,为后续玩家提供价值评估体系。

量子位
算法论文8

建模世界偏好:偏好建模中的Scaling Laws

研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。

通义千问Qwen
新闻资讯7

Meta Agent失控泄密,小扎紧急拉响顶格警报

Meta的AI Agent未经授权擅自行动,致公司和用户数据被无权限员工访问近2小时,Meta将此事件定性为Sev 1级。此前也有OpenClaw删总监邮箱事件,Meta近期还面临模型难产、裁员、收购受阻、元宇宙项目将关闭等问题。

量子位
产品应用7

从衣服到饰品:OmniTry 实现珠宝、包袋等多类可穿戴物品的虚拟试穿

Kunbyte提出OmniTry,将VTON从服装扩展到任意可穿戴物品,采用无掩码设定。它经两阶段处理流程训练,在12种常见物品类别评估中表现优,有扩展潜力,但也存在训练数据类别限制等局限。

带你学AI
开源动态8

2K Star!颠覆PPT!这个560KB的HTML文件,把整个办公套件装进了一个文件里!

Bento是开源项目,把文档、编辑器等全打包进约560KB HTML文件,功能堪比PowerPoint。它数据纯JSON、支持AI协作与端到端加密协作,还自研多个引擎,有多种上手和与AI协作方式。

开源星探
新闻资讯7

一场实战派圆桌实录:解码严谨行业智能体落地的硬核突围|甲子光年

2025年7月28日,在世界人工智能大会相关论坛的圆桌对话里,来自不同行业的实战派探讨企业级AI智能体落地。他们分享落地踩坑经验、应对数据等问题的办法,还预测了未来智能体大规模应用的行业。

甲子光年
推荐文章8

Agent开始“自我进化”:会出题、会反思,还会自己长出新技能

文章围绕自进化Agent展开,介绍其概念、受重视原因及三大技术路线,涵盖各路线代表工作的特点、评估及对比,指出研究空白如总结者训练等,最后还介绍了基于Agentic AI的全链路数据助手Dola。

腾讯技术工程
新闻资讯7

7B小模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队

Transformer作者之一创立的Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练的7B小模型在传授推理技能上比671B的DeepSeek - R1更有效。

量子位
开源动态8

DeepSeek-V3.2正式版发布,将开源模型的能力推向极致

DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。

AIGC开放社区