原生AOT」共找到 496 篇相关文章

开源动态8

刚刚,首个空间原生的具身视觉基模开源!机器人更会看我们的世界了

蚂蚁灵波发布并开源了面向机器人真实任务的空间原生视觉基模 LingBot-Vision 及空间感知模型 LingBot-Depth 2.0,能让机器人更精准地感知世界,解决透明反光材质、小目标和远距离目标等视觉难题。

量子位
新闻资讯8

定义RAG新基准?谷歌发布 Gemini Embedding 2:首个原生多模态嵌入模型,延迟骤降70%

谷歌昨夜推出首个基于 Gemini 架构的原生多模态嵌入模型 Gemini Embedding 2,通过 Gemini API 和 Vertex AI 向开发者公开预览。它可将多类型数据映射到统一嵌入空间,多项基测排名第一,还获早期合作伙伴高度评价。

InfoQ
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0

2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心
产品应用7

10人团队千万融资,这个原生AI产品要做“人人可用的数据Agent”丨对话ChatExcel

ChatExcel是国内首款原生AI DataAgent,专注自然语言对话处理分析数据。其不到10人团队获近千万融资,定位平民化数据产品,核心是多模型结合,已近百万用户,正拓展海外市场。

量子位
产品应用8

业界首个高质量原生3D组件生成模型来了!来自腾讯混元团队

腾讯混元3D团队推出业界首个高质量原生3D组件生成模型Hunyuan3D - Part。现有3D生成算法有局限,该模型提出新范式,含P3 - SAM和X - Part,在多数据集评估中超越现有工作,还给出体验地址和论文地址。

量子位
算法论文8

ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化

NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。

机器之心
推荐文章8

企业软件研发AI转型的坐标系:奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》

奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》。当下模型发展快,但组织转型慢。白皮书构建5×5矩阵,助企业明确自身位置与路径,还剖析软件形态、工程变革等关键内容。

AI科技大本营
产品应用7

在腾讯、育碧的做过游戏后,他转身做 AI 原生游戏,一上线就好评如潮

AI 原生游戏「动物去哪儿」基于真实地理数据,让玩家的小动物开启真实旅行,经历随机事件。创始人太一曾在腾讯、育碧任职,受 AI 启发制作此游戏。目前游戏在观猹获 9.1 分,本周五将邀太一直播答疑。

特工宇宙
产品应用7

谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。

谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。

AI进修生
开源动态7

Arch Gateway: AI Gateway的前瞻选择

AI Agent开发易陷入复杂维护困境,借鉴云原生思路,一些云原生产品朝着AI gateway进化。介绍开源项目Arch Gateway,它是AI原生gateway,具备智能路由、工具调用等能力,能让开发者专注核心业务逻辑。

AI工程化