从零训练」共找到 4882 篇相关文章

产品应用8

上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”

上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。

OpenMMLab
新闻资讯7

黄仁勋拉六大金融巨鳄入局!狂砸5000亿美金建AI工厂:算力即收入

英伟达黄仁勋拉Apollo、黑岩等六家金融巨鳄入局,将调动超5000亿美元资本建AI工厂。他认为AI研究走向生产,算力即收入,且英伟达算力特殊,具备基础设施资产投资属性。

AI寒武纪
开源动态8

8.5K星 Agent 记忆准确率 94.6%,RAG那套被打穿了

AI Agent常没记忆,每次对话像白纸。Hindsight(vectorize-io/hindsight)有8500+ star,是仿生记忆系统,分三层记忆,检索系统TEMPR四路并发,在测试中成绩优异,且上手简单,能让Agent经验学习。

CourseAI
7

1.4亿宝可梦玩家,都在给AI免费打工…

1.4亿《精灵宝可梦Go》玩家10年拍300亿张实景图,为Niantic免费收集数据。Niantic用此数据训练VPS视觉定位系统,提升机器人配送效率,还获巨额投资,剥离游戏业务专注空间AI。

量子位
算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。

DeeplearningAI
算法论文8

智能体「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了

在LLM/VLM驱动的智能体强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能体成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。

量子位
开源动态8

蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王

蚂蚁开源团队推出 Ring-1T 模型,它结合强化学习与多阶段推理机制,实现‘模仿’到‘思考’的转变。该模型在多基准测试表现优异,其高性能得益于 IcePop、C3PO++、ASystem 三项关键技术。

AI科技评论
开源动态8

面向长时语音与声音克隆的全模态开源万能聊天机器人MGM-Omni

文章介绍了全模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备长语音理解、生成、流式生成、样本语音克隆等特性,还给出安装、使用方法,展示评估结果。

GitHubStore
开源动态7

以小博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能

dots.ocr是多语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练三阶段及SFT阶段关键策略。

PaperAgent
新闻资讯8

你以为百度慢了,其实它在走一条最难的路

2025 WAIC 上,百度展示多项成果。萝卜快跑获上海牌照、入选‘国家展’,商业化加速;慧播星推 NOVA 数字人技术;飞桨平台等也入选‘国家展’。百度构建全栈架构,把 AI 炫酷变好用。

MacTalk