空间理解能力」共找到 4037 篇相关文章

新闻资讯8

奥特曼「红色警戒」5个月后,GPT Image 2屠榜,断层领先反杀谷歌

被Google按了半年头,OpenAI祭出反杀。GPT Image 2上线12小时登顶Arena文生图榜,领先Nano Banana 2达241分。它是从零重构的通用模型,具备原生思考能力,或改写图像生成赛道规则。

新智元
推荐文章8

Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础

著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。

机器之心
开源动态8

图像、视频一模搞定!字节全能原生多模态本地可部署

字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。

AIGC开放社区
新闻资讯7

国产算力正在进入Token标准化时代

2026年6月17日,是石科技攒局国产异构算力创新发展论坛。其创始人闫博文认为国产算力瓶颈在工程化转化能力。是石科技正将异构算力转化为标准化Token生产能力,还启动B轮融资。

量子位
新闻资讯7

谢尔盖·布林重启「创始人模式」?谷歌组建「突击队」,重押「AI编程」

近日媒体报道,谷歌组建由研究人员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始人谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。

机器之心
新闻资讯7

Karpathy 教它的 nanochat 数单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
开源动态7

字节开源了一个了不得的模型!

字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。

探索AGI
新闻资讯8

GPT-6 Astra发布,多个基准测试接近满分,“欢迎来到AGI时代”?

当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在多测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。

DeepTech深科技
开源动态8

0.9B跑出90%真机成功率!上海交大为VLA补上空间

上海交大MINT团队提出中间路线Evo - Depth,约0.9B参数,不额外增硬件负担,兼顾仿真与真机性能及部署效率。系统由IDEM、SEM等组成,代码等已开源。

量子位
产品应用8

谷歌Gemini 3.1新模型深夜掀桌, 每秒狂飙363 token! 1/4价格暴击Claude

谷歌深夜推出Gemini 3.1 Flash-Lite,输出速度363 token/s,价格仅0.25美元/百万Token,跑分碾压GPT-5 mini和Claude 4.5 Haiku。开发者可通过Google AI Studio体验,企业用户可通过Vertex AI接入。

新智元