「无预训练模型」共找到 8600 篇相关文章

产品应用8

机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力

英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。

AIGC开放社区
开源动态8

多人会话视频生成新突破:香港科技大学,浙江大学用单人数据实现多人交互视频生成

香港科技大学、浙江大学等开源 AnyTalker,提出音频驱动多人交互生成新范式。它用创新机制和两阶段训练策略,以少量数据实现多人视频生成,还构建评估指标,性能超现有方法。

AIGC开放社区
产品应用8

教育行业首个AI Agent落地!斑马口语「超人类外教」诞生

教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。

量子位
产品应用8

大涨240%,Doc-Researcher确立多模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。

PaperAgent
新闻资讯8

马斯克狂烧14万亿,5000万H100算力五年上线!终极爆冲数十亿

马斯克宣布5年内实现5000万张H100的算力,成本超2万亿美元。他已有Colossus超算集群,Grok系列模型也展现强大实力。目前Colossus 2在分批落地,供电采取多元化措施。

新智元
开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
新闻资讯7

谷歌实验室推出了 Opal,一个用于创建 AI 迷你应用程序的可视化平台

谷歌实验室推出实验性无代码工具 Opal,可让用户通过自然语言和可视化编辑器创建 AI 小应用。它支持两种交互模式,开发完成后能分享链接。开发者关注其与微软产品竞争前景。

InfoQ
推荐文章7

为 Agentic AI 的黎明构建地基

文章指出大语言模型虽耀眼,但企业级解决方案需坚实数字底座。在 Agentic AI 时代,数据范式、基础设施哲学都要重塑,智能体模式崛起带来挑战与机遇,技术决策者要做好底座构建。

AIGC开放社区
开源动态7

MIT团队完成AI控制人类行为实验项目

MIT团队的Human Operator项目是实时人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。

GitHubStore
算法论文8

AI生成操作系统新突破!上海交大提出文件系统开发新范式:从此只需写规约

上海交大IPADS实验室团队在自动生成操作系统核心组件上有新突破。面对大模型生成操作系统的难题,提出SysSpec新范式,以规约指导生成,并配套工具链,构建SpecFS文件系统,开发效率提升3 - 5倍。

量子位