「生成式任务」共找到 4159 篇相关文章
更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画
香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。
为什么「高价值任务」成了所有 AI Labs 的T0 级战略?| 拾象 AGI 备忘录
过去一季度模型进步显著,头部 AI labs 战略对齐,将 coding 列为 T0 级战略,争抢高价值任务。文中还探讨了 AI 对企业 SaaS 的冲击、ToC/ToB 二分法的过时、硬件挑战及高价值任务的二八结构等问题。
视觉Token注入CLIP语义,走向多模态理解与生成新范式
腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。
Seedance 2.0刷屏后,字节还有个硬核模型——3个复杂任务实测Seed 2.0
作者作为AI编程工具深度用户,没追热门的Seedance 2.0,而是实测同期发布的豆包大模型Seed 2.0。设计3个日常复杂任务,在TRAE接入其Pro版测试,展现出强大的自主纠错和多任务处理能力,也指出了不足。
Anthropic最新经济指数:AI让高学历任务提速12倍,但也可能让你的工作“降级”
Anthropic通过‘经济指数’项目,对Claude.ai和其API对话分析。最新报告引入‘经济基元’,基于2025年11月样本分析,揭示AI对任务、职业和总体影响,如让高学历任务提速12倍,也可能致岗位‘技能降级’。
从捍卫者到引路人,上交&上海AI Lab提出LEGION:不仅是AI图像伪造克星,还能反哺生成模型进化?
AIGC技术发展使AI图像滥用问题严重,公众面临信任危机。上交与上海AI Lab等团队在论文中从构建数据集、设计模型、实现检测与生成统一三方面破局,LEGION能检测伪造,还可反哺生成模型进化。
太逼真!豆包·播客模型来了:一句话生成「苏超联赛」播客,很懂13太保的梗
火山引擎发布豆包·播客模型,生成的AI对话语气、停顿等像真人。操作简单,生成快且有字幕。能处理多种类型内容,如热搜话题、苏超联赛、超长文本等。其基于端到端实时语音模型,有技术突破。
卡内基梅隆大学开源LegoGPT,用AI设计乐高模型
卡内基梅隆大学开源LegoGPT,可依文本提示生成物理乐高模型。它把乐高设计转为自回归文本生成任务,基于LLaMA - 3.2 - 1B - Instruct微调,应用场景广泛,如教育、玩具设计等。
智源清华带来PAM,手物交互数据生成新SOTA | CVPR 2026
北京大学、清华等联合提出统一引擎PAM,能整合姿态、外观和运动。用户提供初始和目标姿态及物体几何形状,它就能生成逼真手物交互视频。其效果超现有方法,合成视频可用于数据增强。
标准化3D生成质量榜单来了!首创层次化评价体系,告别“谁的demo更吸睛”主观评估
Hi3DEval团队推出面向3D内容生成的全新层次化自动评测体系Hi3DEval,设计对象级、部件级与材质主题三层评测协议,在HuggingFace发布首期3D生成榜单,涵盖30个主流与前沿模型。