「多主体视频生成」共找到 2695 篇相关文章
震撼全网!3位00后夺200万大奖,卷走鹅厂顶级Offer
历经四个月,「腾讯广告算法大赛」战果揭晓,「Echoch」战队夺冠,另有两支战队杀入三甲,前十名全员获鹅厂Offer意向书。赛事揭示推荐系统正迈入「端到端生成」新纪元,各战队方案亮点多。
多模态推理最高加速3.2倍!华为诺亚新算法入选NeurIPS 2025
华为诺亚方舟实验室研究入选NeurIPS 2025,其提出视觉感知投机推理(ViSpec)框架,解决草稿模型处理图像信息效率难题,在不牺牲生成质量下,对主流VLM最高达3.22倍推理加速。
这个开源模型的UI审美碉堡了~
当下流行基于大模型生成HTML源码可视化文本内容,网页审美对模型很难。早期用Claude 3.7,后有DeepSeek V3 0324等。Tesslate开源基于Qwen微调的模型,尺寸全,审美佳,想象空间大。
OpenAI关停Sora!25个月从封神到退场
OpenAI宣布关停Sora,其曾风光无限,从2024年发布技术预览到2025年Sora 2上线火爆,后因国产模型突破、版权危机热度退潮。此举是战略调整,为筹备IPO聚焦商用与代码开发。Sora败退,AI视频进入‘中国时间’。
基于风雷软件的NF3数字风洞
在第四届智能流体力学产业联合体大会发布的数字孪生风洞「风神NF3」相关技术在《太阳能学报》发表。基于风雷软件构建西北工业大学NF - 3数字风洞,可自动生成网格、高效计算,实现飞行器翼型数值模拟自动化和业务化运行。
再见,程序员!硅谷全员AI Coding,卡帕西宣告9级地震来了
2025年12月27日,Andrej Karpathy推文指出软件工程职业正被重塑,引发开发者恐慌。知名博主Theo称该领域已到永久性拐点,现在70% - 90%代码由AI生成,程序员角色将重构,还给出应对指南。
仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式
中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。
实测谷歌AI故事书,我实现漫画和绘本自由了
谷歌Gemini推出免费StoryBook工具,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工具,获网友好评。
AI「偷学」你的数据?6大顶级机构联手提出数据保护4大分级体系
生成式AI普及,数据保护成挑战。来自多机构研究者发布论文,提出全新数据保护分级体系,分为数据不可用、隐私保护、可溯源、可删除四级,还探讨了技术、法规及面临的挑战。