大模型技术」共找到 10333 篇相关文章

开源动态8

里程碑!逻辑智能发布全球首个完全开源语音模型框架LLaSO,语音AI迎来新纪元

逻辑智能发布全球首个完全开源语音模型框架LLaSO,它像“全家桶”,提供高质量数据、统一评测基准和强基础模型。语音模型发展遇瓶颈,LLaSO框架及参考模型LLaSO - Base有望打破僵局。

AI科技评论
开源动态8

探针伸进模型黑箱,南加州学华人团队打造AI记忆研究的深空望远镜

南加州学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
产品应用8

跨机器、物体与各种任务!RoboScience发布通用具身模型

RoboScience机器科学发布Visics通用具身模型并披露VLOA技术架构。该模型从底层搭建全新具身基础表征单元,适配任意机器人、物体和任务。其由具身世界模型和通用操作模型组成,有强泛化和操作能力。

AIGC开放社区
新闻资讯7

“通用模型微调成为行业模型是伪命题”?医疗AI深度重构,传神语联创始人何恩培:孪生智能体能砍70%线下复诊工作

本文为《2025 年度盘点与趋势洞察》系列访谈,传神语联创始人何恩培分享医疗 AI 发展看法。他认为通用模型微调成行业模型是伪命题,介绍了传神素问中医模型应用,还对比中西医 AI 化差异,探讨未来发展场景与挑战。

InfoQ
推荐文章8

小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,模型应用集成协议三件套。

文章面向有一定技术基础但不熟悉模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三主流集成协议,分别解决不同的集成难题,三者构成模型应用集成完整生态。

AI大模型应用实践
算法论文8

模型幻觉的源头找到了!清华团队锁定模型宁愿说谎也要讨好人类的神经元

清华学研究团队深度解剖语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
算法论文8

腾讯混元数字人团队发布Moral RolePlay基准,揭秘模型的「道德困境」

腾讯混元数字人团队和中山学推出「Moral RolePlay」测评基准,评估模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂性的局限,还给出未来对齐技术方向。

机器之心
算法论文8

模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了模型训练的数据依赖难题。

新智元
算法论文7

逆强化学习全新视角的模型对齐技术

文章从逆强化学习(IRL)视角回顾LLM对齐进展。先介绍强化学习基础及挑战,将LLM生成过程化为MDP,探讨无奖励函数的MDP,说明需神经奖励模型,还阐述通过奖励建模实现IRL及多种优化方法。

PaperAgent
算法论文8

模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。

机器之心