「数据工作流编排」共找到 2916 篇相关文章
DeepSeek-V3.2正式版发布,将开源模型的能力推向极致
DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。
深度讨论 Gemini 3 :Google 王者回归,LLM 新一轮排位赛猜想|Best Ideas
近期,OpenAI、Google、Anthropic 先后发布新模型,引发大模型竞赛。本文聚焦 Google 发布的 Gemini 3,从算力、数据、架构等维度剖析其强大原因,探讨大模型竞争新格局,还涉及多模态、硬件、商业化及产品形态等方面。
Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了
Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。
监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力
清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画
3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。
财报里的AI医生「大为」,撬动京东健康价值重估
京东健康AI医生「大为」让用户足不出户解决就医问题。财报显示其已覆盖超1000种病症,“618”服务用户数同比增近4倍,满意率超98%。它凭借数据、场景和履约能力实现问诊到服务落地,并探索长期健康管理。
刚刚,Fable-5之下,智谱开源的GLM-5.2拿下AI编程第一!
智谱开源的GLM - 5.2在AI编程领域成绩斐然,在Arena获全球第二、Design Arena全球第一,八项基准测试表现亮眼。经多方面实测,它在长程任务中优势明显,标志国产开源模型进入开发者工作流和硬核工程阶段。
openJiuwen社区首发Team Skills,定义Coordination Engineering新范式
文章围绕多智能体系统协作问题,指出传统任务编排方式的局限。华为JiuwenClaw团队发布Coordination Engineering新范式,通过Agent Team、Team Skills等能力,解决团队组建、技能沉淀、复用及进化等问题,并以旅行规划为例展示实战效果。
开源基金会:使用 Apache Iceberg 和 SparkSQL 构建可复制的 ML 系统
文章指出传统数据湖在机器学习工作负载的事务保证和版本控制方面表现不佳,而 Apache Iceberg 与 SparkSQL 结合,能带来数据库般的可靠性。文中介绍其优势、构建可重现特征管道方法、生产实施案例及相关最佳实践等。