「行业赋能」共找到 5967 篇相关文章

开源动态8

攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。

机器之心
开源动态7

如何“驯服”你的Agent?这可能是你见过最优雅与可控的Agent框架 | 深度体验

文章聚焦对话式Agent,指出LLM不确定性是企业应用Agent的障碍。介绍Parlant框架,它用ABM方法控制交互,能降低LLM负担、处理边缘场景。还通过构建10086客服助手展示其使用,最后与LangGraph对比。

AI大模型应用实践
产品应用8

GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑

GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从大模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力。

InfoQ
算法论文8

大模型幻觉检测新方法:实时高亮不确定内容

来自苏黎世联邦理工学院等机构团队,开发流式幻觉检测器,能在生成过程中即时标记幻觉实体。核心是识别具体“实体”是否虚构,实验表现出色,团队已将数据集和代码开源,有局限但应用前景好。

AI工程化
算法论文8

英伟达的AI已经开始接管整个项目了?SATLUTION自主进化代码库登顶SAT竞赛

NVIDIA Research提出SATLUTION框架,将LLM代码进化能力扩展到完整代码库规模,能处理复杂项目。它协调LLM智能体对SAT求解器代码库迭代优化,在SAT竞赛中超越人类冠军,成本低且效率高。

机器之心
算法论文8

DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍

扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
算法论文8

ICCV 2025 | 基于时序增强关系敏感知识迁移的弱监督动态场景图生成

北大王选所团队发表论文 TRKT,针对弱监督动态场景图生成任务目标检测质量瓶颈,提出时序增强关系敏感知识迁移方法,含关系敏感知识挖掘和双流融合模块,实验证明能提升场景图生成质量。

机器之心
推荐文章8

一文读懂 RAG 与 KAG:原理、工程落地与开源实战(含代码与链接)

文章介绍RAG与KAG,RAG从文档找证据回答,适合开放域、时效更新快场景;KAG将结构化知识融进生成过程,实体关系与事实一致性更稳。还给出实战建议、工作流要点、最小可跑示例、开源组件及项目等。

机器学习AI算法工程
开源动态8

面向长时语音与声音克隆的全模态开源万能聊天机器人MGM-Omni

文章介绍了全模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备长语音理解、生成、流式生成、零样本语音克隆等特性,还给出安装、使用方法,展示评估结果。

GitHubStore
产品应用8

AI云的大考来了:企业要的不再是参数,而是盈利 | 甲子光年

历经3年大模型热潮,AI云市场提问改变,企业更关注平台模型实用性和故障恢复能力。百度云智大会聚焦新一代智能基础设施与平台升级,其智能云连续六年排名第一,此次升级回应企业落地AI的核心问题。

甲子光年