内容信号机制」共找到 1807 篇相关文章

算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学

上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制

量子位
开源动态7

开源播客TTS神器!高效TTS模型:Muyan-TTS,0.33秒生成1秒音频,零样本语音合成!

介绍新发布的开源TTS模型Muyan - TTS,它专为播客场景设计,以超低延迟实现零样本语音合成,预训练大量播客数据,支持长内容连贯生成,还介绍了使用步骤、适用场景等。

开源星探
新闻资讯8

LiblibAI 母公司完成近 3 亿美元融资:AI 应用层开始进入「收入说话」的阶段

近日,演语科技披露近3亿美元B+轮融资,投后估值超20亿美元。其旗下有LiblibAI、LibTV、星流等业务,已构建AI创意内容生产应用矩阵。截至2026年5月,ARR达3亿美元,收入年同比增超3000%。

AI科技评论
7

奥特曼「一张脸」引爆全球狂欢!Sora 2冲上APP榜第三,邀请码炒到1250元

Sora 2上线不到24小时冲上苹果商店榜单前三,其「1换4」邀请码机制和「Cameo自我上传」玩法引发社交传播热潮,邀请码被黄牛炒作。同时,它也引发OpenAI内部争议,CEO奥特曼为其辩护。

新智元
新闻资讯7

不止萌兔蹦迪!狸花猫竖中指,吃奶婴儿开飞机,魔性AI视频让人停不下来

AI正席卷短视频,从“兔子蹦床”到“婴儿开飞机”,魔性剧情吸睛又迷惑,背后是算法驱动的流量生意。虚假内容泛滥,4大YouTube频道已全面AI化,“AI垃圾”或已暗中攻占人类心智,是时候普及“AI防诈”知识了。

新智元
开源动态8

开源真强大,不敢相信,太真实,揭秘8.3k star 开源神器 VoiceCraft 如何封神!!!

VoiceCraft 是多团队合作推出的零样本语音编辑与 TTS 开源项目。它能几秒克隆语音,实现编辑功能,支持零样本文本转语音,在真实场景音频中性能超 XTTS - v2、VALL‑E 等模型,解决了内容创作和编辑痛点。

小华同学ai
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理
产品应用7

微信悄悄上线AI播客,新闻主播们的活儿可能真要被抢了。

微信正在灰度内测AI播客,入口在“快讯”页面。它从重要新闻中挑内容分类改写,以双人对话方式播读。此前公众号后台也尝试AI声音。此功能适合资讯新闻,未来或能盘活更多信息场景。

数字生命卡兹克
新闻资讯8

我嘞个豆!中国企业牵头,ICLR这场Workshop被挤爆了

ICLR 2026在巴西线下举办,华人活跃其中。一场由阿里妈妈牵头的Workshop被围得水泄不通,聚焦机制设计与决策智能,这是ICLR历史上首个该方向Workshop,集结了顶尖高校,探讨AI重写下的相关问题。

量子位
算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位