「输出风格」共找到 448 篇相关文章
AI又封神了!华人新作直出憨豆+《猫和老鼠》,平行宇宙对上戏了
新智元报道,阿联酋MBZUAI团队论文提出CCE和CCA机制,解决AI让不同风格角色同框时的“风格错乱”问题。让憨豆、汤姆等角色自然互动,模型在多角色任务指标上领先,或重写虚构边界。
紫东太初开源视觉神经增强方法,即插即用终结多模态幻觉 | ACL 2025
中科院自动化所等团队提出VHR方案,通过“视觉神经增强”机制放大模型视觉关键注意力头输出,降低幻觉现象。此前主流方法多作用于最终输出阶段,VHR深入干预内部机制,还介绍了SSL语义引导方法。
Vidu Q2的参考生视频,是AI视频多参党的胜利。
作者分享使用Vidu Q2多图参考生视频的体验,认为它是AI视频多参党的胜利,是新工作流范式。Q2在一致性、表演能力和多风格表现力上大幅进化,价格实惠,还推出APP,多图参考生视频未来可期。
狂揽53.7K Star!这款强大优雅的终端美化神器,进度条、表格、Markdown应有尽有,绝了!
在Python开发中,默认`print`函数输出单调,影响开发体验。开源工具`Rich`可解决此痛点,它由Textualize团队开发,有富文本和精美格式输出功能,自带表格、进度条等功能,在GitHub获53.7K Star。
AIAA J | 香港理工大学王旭等:目标导向的特征提取-以特征构建增强数据驱动模型
该论文通过对比学习理清潜在输入特征与目标输出的关联性,提出输出驱动的输入特征构造方法。所构造特征在高维代理模型构建中增强效果显著,还可减少预测误差分布及不同模型收敛性和鲁棒性差异。
真香!我用AI做PPT的血泪史:从“能用”到“真香”,V3版到底解决了什么?
作者因公开分享需做PPT,尝试多种AI PPT工具后,自己围绕Agent攒了一个。从V1到V3版不断改进,V3用多Agent提示词用法,风格多样且规则减少,还给出3步制作PPT的方法及后续功能拓展想法。
The Batch:834 | 更一致的人物与风格
德国 Black Forest Labs 的 FLUX.1 Kontext 系列文本生成图像模型,可可控编辑图像。有 max、pro 和 dev 版本,功能含角色一致性和图像编辑,在测试中表现优,公司计划公开专有评估基准。
世界模型一口气输出小时级视频不跑偏,开源了
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
对噢!为什么LMs就不能直接输出答案+confidence呢?
当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在多个数据集实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。
“这个怎么组装?”一句无害的问题,如何让AI产生危险输出
Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。