「专家并行性」共找到 1160 篇相关文章
MiniMax M2 发布即爆,拿下开源模型第一名
10月27日,MiniMax发布新一代文本大模型M2及由其驱动的MiniMax Agent。M2是专家混合模型,参数达230B但激活仅10B。它在开源模型评测中夺冠,能低成本、高速度支撑工作流,开发者评价高。
纽约时报:AI会冲击谁的就业?年轻人还是资深员工?
在微软等科技公司裁员浪潮中,专家就AI会冲击谁的就业展开辩论。有人认为职场新人易被取代,也有人觉得资深员工更脆弱。不同研究指向不同结果,且一些公司已减少招聘初级或资深员工。
刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想
本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。
AI Coding 之后,如何让 Agent 进入企业研发全链路?得物推荐的 Harness 实践
得物资深技术专家白忠魏在AICon大会分享实践。团队目标是将AI Coding扩展为全链路方法,介绍了PDCA循环、全链路前提、七阶段护栏等探索,还提及用知识体系和混合Agent架构解决问题,已有阶段性成果。
比传统方法强7倍:Anthropic物理隔离危险知识,重塑大模型安全训练范式
Anthropic团队提出选择性梯度掩码技术(SGTM),在训练阶段将危险知识物理隔离到特定参数并剔除,实现安全性与通用能力更好平衡,抗恢复性是传统方法7倍,还能处理未标记危险数据。
上海AI Lab发布混合扩散语言模型SDAR:首个突破6600 tgs的开源扩散语言模型
上海人工智能实验室提出全新范式SDAR,通过‘训练 - 推理解耦’融合AR模型高性能与扩散模型并行推理优势。实验证明,SDAR性能与原版AR模型持平或超越,还能加速推理,且已全面开源全系列模型。
AI 产品定价指南:按量定价的卡点到底是什么?
本文编译 a16z 与 Scott Woody 访谈,探讨 AI 改变软件定价逻辑及企业应对策略,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点,指出按量定价的难点、适用模式及企业转型要点等。
让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-Taught RLVR
京东和中科院信工所开展Self - Taught RLVR系列研究,连发三篇论文。从RLSD、NPO、CoPD三个维度探索让大模型自我指导。如RLSD解决信息泄漏,NPO引入有效学习信号,CoPD整合多专家能力,各有创新与良好效果。
看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了
Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。
HAMi 2.7.0 重磅发布 | 异构芯片全面拓展,调度更稳、生态更强
Dynamia密瓜智能宣布发布HAMi 2.7.0版,在硬件生态、调度器、应用层生态等方面有显著进展。硬件上支持昆仑芯、燧原、AWS等芯片;调度器优化了资源计算和可观测性;应用层与vLLM、Xinference等整合。