数据消费范式」共找到 3396 篇相关文章

算法论文7

Qwen3 变身扩散语言模型?不从零训练也能跑,30B参数创纪录

扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。

机器之心
新闻资讯7

对话 Plaud 莫子皓:你还记得 PMF 的感觉吗?

本文是对Plaud中国区CEO莫子皓的采访。Plaud是全球成功的AI硬件Startup,产品大卖。莫子皓分享业务、增长原因,探讨PMF、产品形态迭代、功能亮点,还谈及产品定位、人群、未来计划及进入中国市场决策等。

Founder Park
新闻资讯7

他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!

37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。

新智元
推荐文章8

配置驱动的动态Agent架构网络:实现高效编排、动态更新与智能治理

本文提出配置驱动的独立运行时 Agent 架构,解决低代码/平台化 Agent 方案企业级落地难题。介绍其核心架构、注册中心、配置定义等,还提及 Agent Studio、执行引擎等,阐述运行部署、协作、治理,提供通用可落地范式

阿里云开发者
8

OpenAI 内部是怎么使用 Codex 的.pdf

文章基于对 OpenAI 工程师的采访和内部使用数据,汇总了 Codex 在 OpenAI 内部的使用案例和最佳实践。展示其在代码理解、重构迁移等七大场景的应用,还给出使用的最佳实践,认为未来潜力大。

AGI Hunt
算法论文8

VerlTool重塑Agentic RL的训练生态

当前LLM像‘缸中的大脑’,缺乏与外界互动能力。新范式ARLT兴起,但构建训练框架面临诸多挑战。VerlTool作为统一、模块化、高效的开源框架应运而生,解决难题,在多任务实验表现出色,推动LLM向智能体转变。

深度学习自然语言处理
推荐文章7

AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析大模型应用可观测技术,分享实战案例,还给出未来规划。

InfoQ
开源动态8

群核科技开源两款空间大模型,想解决 Genie3 没能彻底解决的问题

2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间大模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。

Founder Park
新闻资讯7

首个为手机而生的通用 Agent?!苹果做不到的事,“野路子”智谱抢先实现了

苹果预计 2026 年升级 Siri 实现自主行动,但完整落地的执行型 Agent 未推出。8 月 20 日智谱发布 AutoGLM 2.0,称是全球首个可在手机用的 Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。

InfoQ
开源动态7

AI图像水印失守!开源工具5分钟内抹除所有水印

一款名为UnMarker的去水印技术,能在5分钟内去除市面上几乎所有AI图像水印,谷歌HiDDeN已被完全破解,SynthID被攻破79%。它保持较高图像质量,已在GitHub开源,凭消费级显卡可本地部署。

量子位