「动态参数生成」共找到 3093 篇相关文章
别再傻傻做视频啦!!!52.1k Star Remotion,把 React 组件变成视频生产线,强到离谱~~
Remotion是用React程序化创建视频的开源项目,可把视频元素写成组件按时间线组合后渲染。它适合有批量生产需求者,不过做真人vlog等传统剪辑软件更顺手,且使用有license限制。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
Codex自改进Prompt:让AI自己把重复工作变成自动化
开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。
开源SOTA!商汤原生多模态一个大脑完成看图、推理、作画
商汤开源日日新SenseNova U1,用NEO - unify架构让像素和文字自由协作,多项指标达开源SOTA,适配10家国产芯片。它能完成看图、推理、作画等多任务,虽有局限,但后续优化值得期待。
谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路
阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。
无需租GPU,一台24GB内存的笔记本就够了!
阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上超越前代,可与稠密模型媲美,支持多模态,已在 Qwen Studio 上线,还能集成第三方编程助手。
AI大牛刘威创立的Video Rebirth,刚刚又完成8000万美元融资
AI视频生成企业Video Rebirth完成8000万美元融资,由AMD Ventures、现代汽车等跨界投资。其由刘威创立,首创Dual Diffusion Transformer架构,新资金用于Bach模型商业化与全球扩张。
Nature子刊封面:牛津提出首个百万级多模态心脏基础模型CSFM
牛津大学团队推出全球首个心脏传感基础模型CSFM,能统一分析多源数据,精准诊断房颤、预测死亡风险等。它打破设备壁垒,让偏远地区也能享用顶级心脏监护,推动全球医疗平权。
一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负
AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台化能力、核心价值,适合专业人士,现可免费下载桌面版。
姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”
姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。