训练数据合成」共找到 4011 篇相关文章

开源动态8

AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
推荐文章7

培养好品味

如今AI时代,软件竞争不再只看能否正常工作,产品品味成关键。文章指出品味是经长期训练的直觉,还给出培养方法,如接触优秀作品、思考喜好原因、大量练习并寻求反馈。

宝玉AI
产品应用7

蚂蚁即将上线通用 Agent

蚂蚁百宝箱团队将在今年外滩大会正式上线 Tbox 超级智能体,其产品形态与部分平台相近,能让不同角色分工协作。实测显示它在多方面表现不错,但也存在细节不足,官网有诸多案例。

特工宇宙
算法论文7

高效大规模创新3D重建模型iLRM

多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。

AIGC开放社区
推荐文章7

老年代的“滞留对象”:一次由提前晋升引发的线上内存告警排查

文章以线上环境内存告警排查为例,介绍过程和思路。发现老年代因大量不可达对象占用且未触发FullGC致告警,排查出对象提前晋升是主因,还给出调整参数、减少对象产生等解决办法。

阿里云开发者
新闻资讯7

Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略

Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。

AGI Hunt
算法论文8

简单即强大:全新生成模型「离散分布网络DDN」是如何做到原理简单,性质独特?

本文作者杨磊介绍全新生成模型离散分布网络DDN,它建模目标分布机制简洁独特,有零样本条件生成等特性。文中详述其原理、网络结构、损失函数,还展示实验效果,最后给出未来研究方向。

机器之心
新闻资讯8

奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了

当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。

新智元
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
开源动态8

当大模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ