大模型对齐」共找到 9183 篇相关文章

产品应用7

AI应用如何落地政企?首先不要卷通用模型

ISC.AI 2025会显示智能体技术加速渗透产业。360政企AI业务与智能体深度绑定,其落地有三重逻辑:不追通用模型,聚焦小场景;用“乐高式”工厂赋能;安全与AI深度融合是必选项。

量子位
新闻资讯8

模型进入研发体系后,我们看到了这些变化

InfoQ《极客有约》X AICon 直播邀请同程、网易、百度工程师,探讨模型入研发体系的变化。涉及提效、协作、角色分工等方面,还谈及工程师特质、效率焦虑、岗位数量等问题,6 月北京 AICon 会将深入交流。

InfoQ
新闻资讯7

养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

根据OpenRouter数据,上周中国模型周调用总量飙升至4.19万亿Token,再度超越美国登顶全球。中国产品在全球模型调用量Top 5中占三席,国产模型受青睐,但在速度和价格方面仍待提升。

量子位
算法论文8

人格向量:模型性格的数学解码与精准操控

语言模型在应用中会出现危险行为偏移与训练引发的非预期偏移,传统方法难监控干预。本文发现人格特质在线性方向表现为“角色向量”,实现提前预测、实时监控和主动控制,为AI安全提供数学框架。

深度学习自然语言处理
8

模型狂叠 buff、Agent乱战,2025洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?

InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了模型、Agent、AI Native等发展趋势。

InfoQ
算法论文7

AI集体“听不懂”!MMAR基准测试揭示音频模型短板

MMAR基准测试对30款音频相关模型进行测试,结果显示,多数开源模型面对复杂音频推理任务远未达实用水平,音乐任务中所有模型表现不佳,且有显式推理能力的模型表现更优。

量子位
产品应用7

用 Docker 跑模型训练,Unsloth 解决了环境配置难题

Unsloth AI 发布 Docker 镜像版本,解决本地训练模型环境配置难题。拉镜像就能训练,依赖和示例 notebook 都打包好。使用简单,不过有暂不支持 Mac 系统等限制,单卡 NVIDIA GPU 场景较适用。

AI工程化
算法论文8

AI失忆术!只需3个注意力头,就能让模型忘记「狗会叫」

Meta和纽约学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
算法论文8

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率幅提升

扩散语言模型发展迅猛,或成下一代语言模型基础范式有力竞争者。复旦学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。

机器之心
产品应用7

Cursor发布首个编程模型!代码生成250tokens/秒,强化学习+MoE架构

Cursor 2.0正式发布,搭载自研模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。

量子位