图数据」共找到 2710 篇相关文章

开源动态8

极客大神构建了LLM架构画廊,AI大神Karpathy点赞

极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy点赞。画廊高度视觉化、互动性强,展示模型架构及核心参数,源数据开源。

AIGC开放社区
开源动态8

告别直接生成,文生进入Agent时代:港中文联合伯克利开源Gen-Searcher

过去文生多是‘直接出’,遇真实世界知识等易翻车。港中文等团队提出Gen - Searcher,让像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生准确性和质量。

机器之心
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
算法论文8

NeurIPS 2025 Spotlight | FSDrive统一VLA和世界模型,推动自动驾驶迈向视觉推理

面向自动驾驶的多模态大模型存在问题,FSDrive提出“时空视觉CoT”,让模型“以思考”,联合未来场景与感知结果进行可视化推理。该方法在不改动原有MLLM架构前提下激活像生成能力,实验表现出色。

机器之心
产品应用8

李飞飞押注的「世界模型」,中国自研Matrix-3D已抢先实现了?

中国自研世界模型Matrix-3D可单张生成3D世界,效果对标李飞飞的World Labs,还能实现更大范围探索。它有诸多优势,技术上有创新,数据集有特点,应用前景广泛。

新智元
算法论文8

痛点突破:YOLOv26引入AAttn区域注意力机制,精度提升1.3个百分点

文章介绍YOLOv26引入AAttn区域注意力机制,解决传统机制在复杂场景下的不足。它通过划分特征区域学习权重,提升检测精度,且实现简单。经实验验证,精度提升显著,还给出实现细节与优化建议。

机器学习AI算法工程
开源动态8

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强文跨模态模型

360推出FG-CLIP2文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在多业务落地并开放API。

机器之心
推荐文章7

具身智能最“脏”的活,被三个老炮干成了亿元生意|甲子光年

具身智能行业数据是关键卡点,海量数据中能用于训练具身模型的数据稀缺。智域基石提出“数据编译”理念,搭建包含五个环节的管线。该公司已获数千万元天使轮融资,成立4个月订单近亿元,从工业场景切入,规划了三阶段发展路径。

甲子光年
8

苹果应用商店App Store审核指南,审核流程

苹果App Store的审核流程包括准备上传、等待审核、审核中、准备销售等阶段。审核被拒常见原因包括元数据不准确、App完成度不足等。

孔学长
算法论文8

Nature子刊封面:牛津提出首个百万级多模态心脏基础模型CSFM

牛津大学团队推出全球首个心脏传感基础模型CSFM,能统一分析多源数据,精准诊断房颤、预测死亡风险等。它打破设备壁垒,让偏远地区也能享用顶级心脏监护,推动全球医疗平权。

新智元