「尺度对齐参考模块」共找到 446 篇相关文章
Qwen3.8-Flash-Next:SGLang Day-0 支持
2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8 - Flash - Next,它是Qwen4架构早期预览版。SGLang在发布首日就提供完整支持,模型架构多方面升级,亮点众多,还给出启动命令及配置建议参考。
赛博鸡生蛋,7小时用Claude Vibe Coding一个Mini-Claude
本文是小白向文章,用Vibe Coding方式参考Claude实现精简版Mini-Claude。介绍开发流程,含打通LLM API调用、完成tool use调用等步骤,还提及后续待做事项及对AI开发的思考。
腾讯混元数字人团队发布Moral RolePlay基准,揭秘大模型的「道德困境」
腾讯混元数字人团队和中山大学推出「Moral RolePlay」测评基准,评估大模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂性的局限,还给出未来对齐技术方向。
在西部见证了一场极致真诚、极具影响力的科技领袖盛会|GTLC成都站圆满落幕
10月25日,GTLC全球科技领导力大会·成都站圆满举办,以“AI新‘蜀’光”为主题,邀请十余位嘉宾从多角度分享。大会含主题演讲、闭门会和特色活动。多位嘉宾围绕AI应用、企业转型等分享经验,为各行业提供参考。
刚刚,Opus 5来了:性能不输 Fable 5、价格砍半
Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。
音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考
Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。
开源模型首超Opus4.6!智谱GLM-5.1登场,14小时后CUDA专家被冲了
智谱开源模型GLM - 5.1带来重大突破,14小时完成CUDA Kernel优化,加速比大幅提升。它解锁与顶尖闭源模型Claude Opus 4.6全面对齐,在多测试中表现优异,展现长程任务能力,改写行业叙事逻辑。
Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态大模型
中国科学院计算技术研究所团队提出文本-视觉-语音多模态大模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。
从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026
浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。
π0.6和GEN-1谁代表未来?乾坤未定,但这条底层赛道浮出水面
Generalist AI的GEN - 1引发行业关注,其创始人验证具身智能尺度定律。但很多公司在数据质量上遇困。智域基石提出‘数据编译’概念,构建五层编译管线,有独特商业模式,对未来数据路线持‘路线中立’观点。