「实时视频生成」共找到 2889 篇相关文章
35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源
5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。
首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」
港大团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。
TRAE SOLO移动端上线,手机也能干活了,随时随地Vibe Working
TRAE SOLO 移动端上线,实现手机、桌面、网页三端打通,全量开放。它让闪念能无缝接入工作流,还带来实时语音交互、飞书 CLI 接入、定时任务等功能,推动智能体走向新阶段。
一个CLAUDE.md霸榜GitHub第一!蒸馏自Karpathy,6万码农抄作业
一个名为CLAUDE.md的Markdown配置文件冲爆GitHub,本周新增44,465颗星,总星数61.6k,连续三天Trending日榜第一。它源自Karpathy对LLM编程陷阱的观察,含四条规矩,能约束AI编程Agent。
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
斯坦福2026 AI指数报告!中美差距已实质性抹平
斯坦福HAI发布2026年度人工智能指数报告,显示中美在顶级大模型性能上差距已实质性抹平。报告还呈现了AI能力进化、算力格局、智能边界、安全监管、人才流动等多方面情况。
Meta 重磅提出「神经计算机」:模型即电脑
Meta AI和KAUST提出「神经计算机」概念,目标是让神经网络承担计算、内存、输入输出。论文给出完整框架并做原型验证,虽当前原型距目标差距大,但提出问题和定义框架意义重大。
重磅开源!240亿参数力压Nano Banana 2
4月初,京东探索研究院开源JoyAI - Image - Edit图像模型。它是业内首个将「空间智能」写进底层的开源一体化图像模型,能让模型「理解空间,编辑空间」,在电商和具身智能场景极具价值。
CVPR Highlight|让无人机学会自己认路+锁位目标,国防科大给出一套新解法
国防科技大学 SAW Lab 团队联合多高校推出无人机实时地理定位系统「PiLoT」,首次仅靠单目 RGB 序列在 GNSS 拒止环境完成无人机及目标定位,性能达先进水平,成果被 CVPR 2026 接收。
中国AIGC「全家桶」来了!三箭齐发杀入全球第一梯队
3月27日,2026中关村论坛上,天工AI发布游戏世界模型Matrix - Game 3.0、视频大模型SkyReels V4和音乐大模型Mureka V9,杀入世界第一梯队,解决行业顽疾,还发布2026 AGI战略。