「大模型对齐」共找到 9257 篇相关文章
ACL 2025 | 大模型乱试错、盲调用?KnowSelf让智能体有「知识边界感知」能力
ACL 2025 论文《Agentic Knowledgeable Self-awareness》聚焦提升智能体「知识边界感知」能力。KnowSelf 方法让智能体自主调节知识运用,实验显示其性能优,还探索了智能体自我认知多方面影响。
变天了!WindSurf推出workflow功能,低代码大模型应用开发平台将面对“降维”打击
Windsurf在1.8.2版本推出workflow功能,其采用自然语言定义工作流并与开发IDE深度集成,是更高级形态。该功能特性丰富、应用场景多,对Dify等应用编排工具或造成‘降维打击’。
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
刚刚,DeepSeek扔出大杀器,梁文锋署名!暴力优化AI架构
2026新年第一天,DeepSeek发表梁文锋署名新论文,提出「mHC(流形约束超连接)」架构。它仅增约6.7%训练时间开销,就能让27B参数模型性能显著提升,还可能淘汰ResNet结构。
大突破!实验证明,RL能为LLM注入“创新”能力
此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。
OpenAI:人&AI对齐技术应该是一个动态、双向的循环
在NeurIPS 2025上,NYU&OpenAI就Human - AI Alignment发布Tutorial。指出当前对齐像打地鼠,根源是将其当成静态、单向的,提出HAA框架,强调多元目标、人类全链路话语权及社会 - 技术系统量化监督。
效果非常不错!阿里昨开源图形海报生成模型Qwen-Image
阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。
谷歌开源Gemma 3 270M,性能超越Qwen 2.5同级模型
本周四,谷歌发布 Gemma 3 270M 模型,它参数小、功能强,具备指令跟踪等能力。在 IFEval 测试中表现出色,节能且适合多场景,谷歌还提供使用指南和试用途径,Gemma 系列下载量已破两亿。
全球NAND老二,成了老三的第一大股东
8月10日消息,截至8月3日,因贝恩资本旗下公司减持、东芝持续卖出股票,SK海力士通过可转换债券实质成铠侠第一大股东。这一股权变动冲击NAND格局,影响产业整合,关键窗口期在2028年。
我宣布,这就是现在人声最真实的AI音乐模型。
作者体验Minimax新推出的音乐模型Music 2.5,称其真实感强,中文无敌,咬字清晰,能唱维语等多语言。搭配粉丝开发的小工具,可尝试多种曲风,价格实惠,但功能有待完善。