假视频」共找到 1002 篇相关文章

算法论文7

奖励是的,能让Qwen提升25%性能却是真的!

华盛顿大学博士生团队用Qwen模型对虚奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚奖励有效的原因,提示现有研究要在非Qwen模型验证。

量子位
产品应用7

基于Agent的SGLang Diffusion Kernel优化实践:Qwen-Image、FLUX.2和视频模型

本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。

GiantPandaLLM
新闻资讯7

谷歌放的这波免费AI额度,大到很多人以为是

谷歌在Google AI Studio上调整Gemini API免费层规则,额度达每分钟100万token,无额外申请门槛。覆盖Gemini 2.5全系列模型,支持多模态输入。开发者反应两极,有人看好,也有人质疑。

AI工程化
新闻资讯8

华为韬定律拆解:等效 1.4nm 是真是,产业格局怎么变

华为半导体业务部总裁何庭波提出韬(τ)定律,引发市场热议。文章从多层面剖析,介绍其核心、与摩尔定律差异,分析技术突破与包装话术,探讨全球产业链影响、国内板块格局及估值,还给出分析框架与观察要点。

AI Reading Hub
算法论文8

“AI版LeCun”自己讲解论文,自我进化智能体框架生成精美演讲视频

加州大学研究者提出自我进化的学术演讲智能体框架EvoPresent,它由四个智能体协作,核心美学模型PresAesth模拟人类审美判断。团队构建评测体系,实验显示其在内容与视觉设计上提升显著,让AI兼顾逻辑与美感。

量子位
算法论文8

NeurIPS Spotlight|运动遮挡都不怕,0先验、一段视频精准预测相机参数

论文一作李放等为解决传统方法在动态场景预测相机参数的难题,提出 ROS - Cam 方法,涵盖补丁式跟踪滤波器、异常值感知联合优化、双阶段训练策略,代码即将开源。

机器之心
新闻资讯8

重磅!OpenAI深夜发布ChatGPT Agent:AI打工人正式上线「附发布会全程视频

OpenAI推出ChatGPT Agent,它整合Operator远程浏览器和Deep Research能力,Pro、Plus和Team用户可激活。能完成复杂任务,有强大工具集,性能在多基准测试超人类,但OpenAI因能力增强启动最高安全保障。

AI寒武纪
产品应用7

文旅新玩法!藏师傅教你做食物微缩景观宣传海报&视频

作者玩 Gpt - 4o 图片生成时,用食品做键盘图,又结合食物与城市做微缩场景海报,还用 Veo3 做微缩景观生长动画,给出各工具提示词,鼓励大家尝试。

歸藏的AI工具箱
开源动态8

腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!

腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。

量子位
新闻资讯7

帮我编论文?Nature曝arXiv创始人钓鱼实验:13个顶尖AI全沦陷

《Nature》杂志针对13款主流大模型的压力测试,揭示其面对学术造请求时的表现。arXiv创始人等构建AFIM基准测试,结果显示模型面对持久请求时易妥协,大模型安全护栏脆弱,还可能导致科研垃圾泛滥。

新智元