「训练数据生成」共找到 5591 篇相关文章
马斯克最大算力中心建成了:全球首个GW级超算集群,再创世界纪录
全球首个GW级超算集群Colossus 2正式投入运行,马斯克称其4月将升级至1.5GW。这为Grok 5训练提供强大算力。但美国部分地区因数据中心电力需求激增,或在用电高峰对居民轮流停电。
腾讯混元推出首款开源混合推理模型:擅长Agent工具调用和长文理解
6月27日,腾讯混元开源首个混合推理MoE模型Hunyuan - A13B,参数80B激活仅13B,推理快性价比高。它在多测试集成绩好,尤其擅长Agent工具调用和长文理解,还开源两数据集填补评估空白。
扩散语言模型真的会比自回归好?理论分析结果可能恰恰相反
北京大学和蚂蚁集团研究表明,扩散语言模型虽理论上有并行生成优势,但实践中在某些任务推理成本更高。研究通过实验对比,分析了扩散与自回归模型在不同评估指标下的效率,指出选择模型要视任务需求。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
Anthropic逼急谷歌!布林下场亲自督战,组「追杀队」围剿Claude
谷歌联合创始人布林亲自督战,组建攻坚队「追杀」Anthropic,欲夺回编程能力差距。Claude在编程领域锋芒正劲,谷歌AI编码占比仅50%,而Anthropic已达100%。攻坚队聚焦长期写代码任务,策略转向优先训练内部代码模型。
ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化
NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。
蚂蚁开源世界模型LingBot-World:具有分钟级记忆的实时世界模拟器
蚂蚁集团旗下灵波科技开源具身智能模型及世界模型LingBot-World,它将视频生成模型进化成可交互世界模拟器,采用多阶段进化策略,有涌现记忆等能力,虽有不足,但为开源社区构建世界模型迈出坚实一步。
估值1亿的"死了么"APP有多好抄?5分钟AI就能复刻,去年有人一下午做出原型
‘死了么’APP 更名 Demumu,曾登热搜与付费软件榜首。此前一数据分析师用 AI 5 分钟复刻海外版,感叹技术不值钱。该 APP 由 3 名 95 后开发,初始成本低,现估值近 1 亿,还涌现诸多类似免费 APP。
2025 AI 趋势报告:Agents 正在跨越鸿沟
《2025 AI 趋势报告》指出,AI 智能体跨过鸿沟被广泛采用,能力比肩人类,成本优势显著,影响招聘。能源成制约,生成式 AI 普及快,收购成主要退出路径,虽估值高但基本面尚好,还分析了下一波创业切入点。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业 AI 培训常难以转化业务价值。极客时间为某制造企业定制 AI 产品经理 OMO 训练营,以业务场景为导向,采用三阶段闭环培养模式,课程覆盖全链路,助企业培养人才、建立培养体系。