「Veo 3.1」共找到 3353 篇相关文章
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
图像编辑缺训练数据?直接从视频中取材,仅用1%训练数据实现近SOTA效果
百度研究人员提出将图像编辑视为退化的时间过程,Video4Edit利用视频预训练模型知识迁移,仅用主流编辑模型约1%监督数据,在图像编辑任务达近SOTA效果,解决数据稀缺与权衡难题。
全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四
Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。
下一代目标检测模型:3B参数MLLM Rex-Omni首度超越Grounding DINO,统一10+视觉任务
IDEA研究院团队用3B参数的Rex - Omni打破MLLM目标定位精度僵局。它统一视觉任务,结合坐标编码与强化学习,在多项检测基准超Grounding DINO等,解决定位和行为缺陷,为MLLM成下一代检测模型提供方案。
256G比5090还贵!内存一年暴涨3倍,全球为奥特曼豪赌买单
全球内存供不应求,价格一年暴涨3倍。奥特曼的采购锁定40%产能,巨头转向高利润AI产品致中低端内存锐减。2026年内存短缺或重塑市场,GPU也将涨价,大家都要为AI发展买单。
“烂出”1.35亿票房?AI二创《牛来》也疯狂,网友都惊呆了
2026年夏天,影视黑马《牛来》在AI二创助力下火出圈,截至8月18日票房破2100万,猫眼预测达1.35亿。网友用AI将其做成解说视频、游戏等,虽AI版精致,但有人认为缺真诚感。
刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」
过去三年,AI 内容生成行业虽有技术迭代,但用户与模型交互仍单向。智象未来发布全球首款原生全模态交互式世界模型 HiDream - O1 - World,它基于 UiT 架构,在评测中表现出色,解决两大行业难题,应用前景广。
蚂蚁深夜开源比肩Genie 3的世界模型,我也看到了具身智能的未来。
蚂蚁旗下灵波科技凌晨开源世界模型LingBot-World,可对标Google Genie 3。它能实时交互生成世界,与视频生成模型不同。有三个版本,具备长时记忆稳定、风格泛化性强、动作代理出色等特点。
说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!
作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。
细节直逼亚毫米级!港科广分层建模突破3D人体生成|CVPR 2025
港科广团队提出MultiGO创新方案,借助分层建模思路突破3D人体生成难题。该方案通过三级几何学习框架提升重建质量,在多个测试集上性能领先,且在多领域有应用优势,研究成果入选CVPR 2025,项目代码将开源。