「DeepSeek 3.1」共找到 3734 篇相关文章
不止剪辑!剪映的未来是一站式AI视频平台
剪映产品负责人宣布,其野心是成为一站式AI成片的创意伙伴。今年对AI文字成片功能系统性升级,整合豆包、DeepSeek模型,新增多种功能,还推出剪小映应用,要打造一站式AI视频编辑平台。
Anthropic 联创曝内部工程师已不写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?
Anthropic联合创始人透露公司工程师已不写代码,通过管理AI Agent系统写代码,工作量达原来2 - 3倍,还提议向AI公司征税。但开发者质疑Claude存在诸多问题,认为AI写代码未到革命地步。
攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0
9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。
英伟达斥资50亿美元联手英特尔,将开发AI基础设施和个人计算产品
英伟达斥资50亿美元入股英特尔,双方将联手开发AI基础设施和个人计算领域定制化产品。合作聚焦数据中心和个人计算,是长期战略联盟。公告发布后,英特尔股价涨超26%,AMD股价跌超3%。
让AI学会潜意识推理,Sapient发布类脑模型HRM
新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率高,开源后GitHub星标突破10.3k。
SGLang支持GPT-OSS:从Day 0支持到性能增强
SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。
企业落地 NL2SQL,需要的是 AI-ready data 和 小模型
当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程化流程’。文章指出先数据后模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程化路径等内容。
“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式
Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。
将数据优势发挥到极致:「杭州六小龙」开源搭建空间智能的第一步
大模型时代数据支撑至关重要。群核科技在首届TechDay为空间智能发布空间语言模型SpatialLM 1.5和空间生成模型SpatialGen,前者学会空间语言,后者实现场景多视角图像生成且具时空一致性,SpatialGen已开源。
快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!
快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。