新视角合成」共找到 3841 篇相关文章

算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握动作、泛化到环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
新闻资讯7

Kimi总裁张予彤北大实录:我们想要有抽象能力和偏执的人|甲子光年

Kimi总裁张予彤在北大分享,谈AI时代人才标准,偏好有抽象能力和偏执的人。还探讨AI创造工作、学校课程设计、企业管理等问题,分享Kimi招人标准、组织特点及对行业诸多问题的看法。

甲子光年
开源动态8

深夜开源首个万亿模型K2,压力给到OpenAI,Kimi时刻要来了?

昨晚,月之暗面发布并开源 Kimi K2 大模型,同步上线更 API,价格 16 元/百万 token 输出。它超过多个开源和闭源模型成 SOTA,展示出领先能力,还介绍训练关键技术,或成模型智能进化关键。

机器之心
新闻资讯7

Token 译名:「智元」

文章讨论Token译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大量智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。

新智元
新闻资讯7

xAI解散,但Grok还在上,马斯克官宣模型

xAI 解散、大批成员离职后,马斯克透露 Grok 最模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。

机器之心
算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,能输出可解释分析文本,助力考古破译。

量子位
算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。

量子位
开源动态8

DeepSeek开源模型,提出上下文光学压缩:LLM的记忆方式

DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。

花叔
算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!

谷歌提出架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个模型,在多任务上表现卓越。

新智元
产品应用7

米哈游蔡浩宇,发了个“游戏版ChatGPT”

米哈游蔡浩宇上AI聊天软件AnuNeko,用户反馈其人性化高但逻辑较弱。AnuNeko出自蔡浩宇公司Anuttacon,该公司此前还推出实验性AI游戏。如今AI+游戏大势所趋,米哈游游也加入更多AI元素。

量子位