动作生成」共找到 2425 篇相关文章

算法论文8

ICLR 2026 | Rebuttal 是一场「带着镣铐的舞蹈」?港科 RebuttalAgent 用心智理论「读懂」审稿人

香港科技大学研究团队提出 RebuttalAgent 框架,将心智理论引入学术 Rebuttal 任务。它通过 TSR 框架拆解任务,先‘读心’再‘落笔’,能生成有说服力回复,还可作为‘思维外挂’提升小模型表现。

机器之心
新闻资讯7

32岁程序员猝死引反思:应给“随时随地办公”设红线;内存条涨速超金条,100根可换上海一套房?DeepSeek工程师误点踩令程序员破防|Q资讯

本文为AI行业资讯汇总,包含32岁程序员猝死反思‘隐形加班’、TikTok官宣美国方案、内存条价格飙涨、燧原科技IPO获受理等热点,还有OpenAI、Meta等公司近期动态,以及行业会议推荐。

InfoQ
开源动态7

“AI火了,我们却快完了!”顶级开源框架Tailwind之父含泪裁掉75%兄弟:半年后,这个项目可能就没了

前端开源项目 Tailwind CSS 正面临生存危机。创始人 Adam Wathan 称因 AI 冲击,一天内裁掉约 75% 工程团队员工,若趋势不变,约 6 个月后无法支付工资。此前社区 PR 也因变现问题被拒。

AI前线
算法论文8

大模型幻觉的源头找到了!清华团队锁定大模型宁愿说谎也要讨好人类的神经元

清华大学研究团队深度解剖大语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
新闻资讯7

PPIO姚欣:AI正在进入自主行动与创造时代,智能体需要全新的操作系统|MEET2026

在量子位MEET2026智能未来大会上,PPIO姚欣表示AI进入自主行动与创造时代,Agent会成未来AI主力,Agent Infra将成新操作系统。PPIO构建AI云能力,还推出Agent沙箱助力厂商落地。

量子位
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区
算法论文8

AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型

火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。

机器之心
新闻资讯8

大模型上天、马斯克发射GPU?中国团队直接建「太空超算」

2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。

新智元
推荐文章7

AI Native 的影像公司们,颠覆赛道的机会来了!

文章指出过去50年影像公司通过推动坐标点向「计算」端移动创造商业变量。如今计算突破天花板,带来理解、增强、生成现实三层价值释放,解锁新场景,AI Native影像公司机会巨大。

Founder Park
算法论文8

NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临

传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。

机器之心