存在论」共找到 8288 篇相关文章

算法论文7

The Batch: 931 | 统一视觉媒体的单一分词器

Apple团队开发多维分词器AToken,可将图像、视频、3D对象映射到共享token空间,统一处理视觉媒体。它由预训练编码器和解码器组成,经多阶段训练,多任务上达或接近先进水平,为视觉模型带来通用性。

DeeplearningAI
算法论文8

ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动

宾夕法尼亚大学研究者提出 VLMgineer,一个全自动工具设计与使用框架,利用视觉语言模型和进化搜索,让机器人自主设计并使用工具。该工作已被 ICLR 2026 接收。实验显示,它工具设计上优于人类提示和现有 Benchmark 工具。

机器之心
算法论文7

JCP | 中科院力学所孙振旭研究员团队:关于物理信息神经网络的预处理:如何流体力学中更好地利用数据

物理信息神经网络(PINNs)为求解微分方程正反问题提供灵活框架,但数据预处理领域待探索。本文提出数据预处理方法,通过对数据和方程归一化,四个湍流案例中提升PINNs流场重建预测准确度,不增计算成本。

力学与人工智能
新闻资讯7

Nature重磅发文:深度学习x符号学习,是AGI唯一路径!

大模型虽惊艳,但权威认为仅靠神经网络难达人类级智能。符号AI曾被边缘化,如今‘神经–符号融合’升温。神经网络与符号算法各有利弊,业界探索出不同融合路径,不过对其能否通往AGI仍争议。

新智元
开源动态7

BettaFish微舆:一个多智能体舆情分析系统

BettaFish微舆可依自然语言需求抓取分析30多个主流社交媒体生成舆情报告。它将任务拆解给不同智能体,系统架构清晰,最终整合生成带时间线分析的HTML报告。项目GitHub开源且登顶趋势榜第一。

AI工程化
开源动态8

Github 斩获 16.3k star,Open Lovable 只需1分钟,就能克隆你的任意网站!

Open Lovable 是 Firecrawl 团队开源项目,能通过 AI 聊天将任意网站转化为 React 应用,支持整站抓取与重组。它解决了多类人群痛点,功能丰富,技术架构有优势,同类对比中表现出色,获 16.3k star。

小华同学ai
开源动态7

推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型

OpenAIgpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:多图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用多样真实数据。实验显示MLLM多图像空间推理有短板,还开发自动化错误分析流程助力改进。

量子位
开源动态8

带图推理碾压同类开源模型!港中文微软等开源OpenThinkIMG框架,教AI学会使用视觉工具

港中文、微软等联合推出OpenThinkIMG开源框架,解决AI使用视觉工具面临的集成难、缺数据、适应差等问题,还公开核心技术V - ToolRL。该框架图表推理任务上表现超GPT - 4.1,为下一代AI智能体提供基础。

量子位
新闻资讯7

政企研联手发力!N 个实战案例!企业数智化转型的石景山企业专属方案重磅登场 | Q推荐

全球人工智能开发与应用大会暨石景山数智化转型峰会(AICon 北京站)将于 2025 年 12 月 19 - 20 日北京石景山举行。大会围绕企业数智化转型与 AI 实战落地,设项目启动会、全国性坛和行业峰会,助企业明确转型路径。

AI前线