「训练数据生成」共找到 5550 篇相关文章
当具身智能遇到“大脑”瓶颈,一家国家队公司决定拆掉围墙共筑基石|甲子光年
2月28日“启智涌现”开发者大会举行,启智机器人试图解决行业软硬件耦合深等矛盾。它打造通用技术底座,用大衍数据平台等构建技能进化引擎,还以新商业模式构建生态飞轮,推动机器人融入各行业。
估值1亿的"死了么"APP有多好抄?5分钟AI就能复刻,去年有人一下午做出原型
‘死了么’APP 爆火并更名 Demumu,虽开发成本低却估值达 1 亿。此前有数据分析师曾用 AI 5 分钟复刻其海外版。该 APP 由三名 95 后开发,现下载量猛增,还面临竞品挑战。
自媒体误读了 DeepSeek-OCR:一图胜千言
近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构新颖,训练讲究,效果出色,为行业带来新思路。
250份文档“毒晕”大模型!无论规模大小统统中招
Claude母公司Anthropic联合两大机构研究发现,仅250份恶意文档就能在不同规模大模型植入“后门”漏洞,打破以往对大模型数据中毒的认知,给厂商防御敲响警钟。
Gemini灵魂人物加盟xAI,马斯克亲自夹道欢迎!
前谷歌DeepMind资深研究员Dustin Tran加盟xAI,他是Gemini共同创造者,助谷歌追回AI风口。Tran介绍跳槽原因,涉及算力、数据和认同马斯克理念,还补刀OpenAI点子库存见底。
腾讯开源智能体构建框架
腾讯开源智能体构建框架 Youtu-Agent,灵活高性能,验证性能出色,开源友好成本低。有自动智能体生成等亮点,适用于不同用户群体,涵盖研究、开发等场景,还介绍核心概念,附项目地址。
具身智能从此「边听边说」,智源研究院开源原生全双工语音大模型RoboBrain-Audio
北京智源研究院联合多方发布原生全双工语音对话大模型 RoboBrain - Audio,采用新架构和创新训练范式,在性能上全面领先,革新音频 - 文本对齐方式,丰富了 RoboBrain 全栈体系,推动具身智能发展。
腾讯提出SPO,告别Group
腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。
谷歌又赢了,nano banana「被迫」改名后,网友搞出7种神仙玩法
谷歌神秘图像编辑模型 nano banana 改名后仍热度高,与竞品相比生成速度快、成本低、能力强。已在 Gemini 应用和 Google AI Studio 上线,网友开发出制作等距模型、标注现实世界等7种玩法。
上下文工程比提示词工程好 10 倍,比 vibe 编码好 100 倍!Karpathy 站台,堪称「全新的氛围编码」。
Andrej Karpathy 提出「上下文工程」概念,Shopify CEO 更青睐它。研究显示开发者因 AI 幻觉和错误多,不信任其生成代码。上下文工程可成 AI 辅助开发核心技能,文中还介绍了相关开源项目及使用方法。