「PhyT2V框架」共找到 3379 篇相关文章
AAAI 2026 Oral | SplatSSC:解耦深度引导的高斯泼溅,开启单目语义场景补全高效新范式
单目3D语义场景补全领域长期受困于密集网格表征,现有‘对象中心’范式也有瓶颈。SplatSSC框架通过深度引导策略与解耦聚合机制,实现性能与效率提升,在实验中表现优异。
摩尔线程天使投资人:对近期AI的四十个观察
摩尔线程天使投资人王捷整理关于AI经济四十个问题,涵盖模型发展、经济影响、就业冲击等方面,如Scaling Law收敛、AI扩散时间、数字层机制等,为探讨AI经济提供观察视角与分析框架。
AAAI 2026 Oral | 手机传感器正在泄露隐私?PATN实时守护隐私安全
移动应用获取手机传感器数据支撑重要功能,但带来隐私隐患。西安交通大学与东京科学大学在AAAI 2026提出PATN框架,基于对抗攻击思想,设计两大核心技术,能在多种场景下守护隐私安全。
出自小米的模块化图像编辑改造:让 AI 学会「搭积木」
小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。
字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作
字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。
用“蒸汽机”生成视频,还能音视频一体化交付?
8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其生成视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。
突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法
AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。
Anthropic 新研究:人们如何使用 Claude 寻求支持、建议和陪伴
Anthropic研究聚焦人们用Claude满足情感需求的情况。发现情感化对话仅占2.9%,人们借此解决现实、情感等问题,对话结束时情绪更积极。但研究有局限,未来需应对诸多挑战。
8秒极速生成!复杂场景图像定制低成本轻松驾驭,已开源丨字节北大联合发布
字节跳动与北大联合推出支持多条件组合的统一图像定制化生成框架DreamO,能实现主体、身份等多样化定制。与商业大模型比,它开源、成本低、速度快,8 - 10秒可完成图片定制。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。