「人类未来」共找到 3270 篇相关文章
Vidu Q2的参考生视频,是AI视频多参党的胜利。
作者分享使用Vidu Q2多图参考生视频的体验,认为它是AI视频多参党的胜利,是新工作流范式。Q2在一致性、表演能力和多风格表现力上大幅进化,价格实惠,还推出APP,多图参考生视频未来可期。
从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」
今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。
EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法
vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。
亿级短视频数据突破具身智能Scaling Law!Being-H0提出VLA训练新范式
真机数据匮乏使具身智能VLA模型发展受限,现有真机数据与所需上亿级训练样本相差甚远。BeingBeyond团队提出创新性方案,利用人类视频手部数据构建数据集,训练出VLA模型Being - H0,经实验验证效果良好。
15年差评如潮,Siri终于有救了!苹果10亿真金白银投谷歌一票
苹果宣布和谷歌合作,用Gemini升级Siri等AI功能,此为过渡方案,苹果未来计划推自研1万亿参数模型。此前谷歌每年付苹果200亿做搜索,这次苹果或每年付10亿用Gemini。
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
AI里最大的Bug,却也是人类文明最伟大的起点。
OpenAI论文指出AI产生幻觉是因其训练方式奖励瞎蒙行为。以考试为例,AI在信息不足时猜测是最优策略。还从统计学解释根源,指出解决幻觉需改变评估指标,也引发对人类想象力起源的思考。
微信悄悄上线AI播客,新闻主播们的活儿可能真要被抢了。
微信正在灰度内测AI播客,入口在“快讯”页面。它从重要新闻中挑内容分类改写,以双人对话方式播读。此前公众号后台也尝试AI声音。此功能适合资讯新闻,未来或能盘活更多信息场景。
训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法
将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。
金融智能体真的是大模型落地“最后一公里”?
InfoQ《极客有约》X AICon 直播栏目邀请业内人士探讨金融 AI 大模型实践现状。指出大小模型融合是主要方案,智能体有应用但也有问题。还分享了评估 AI 项目的要点、智能体应用案例及未来布局方向。