大模型数据」共找到 10047 篇相关文章

算法论文8

多模态幻觉的病因「高熵节点」找到了!全基准幻觉率下降

多模态推理模型的幻觉常出现在生成转折词时,此时模型处于高熵关键节点,易脱离图像证据。研究者提出LEAD,高熵时保留候选推理方向,注入视觉锚点拉回证据,实验显示它能跨领域提升模型性能。

新智元
新闻资讯7

AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起

文章梳理语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。

新智元
产品应用7

黄仁勋预言的100万亿市场,被易鑫金融Agent撞开一道口子

模型在金融行业落地潜力但门槛高。易鑫依托行业经验,推出Agentic AI解决方案,由XinMM - AM1模型和Harness体系组合,覆盖汽车金融全链路,已在风控等场景应用,拉开效率革命序幕。

新智元
新闻资讯7

ChatGPT确认卖广告!奥特曼:挣钱嘛不寒碜

2026年1月16日,OpenAI官宣ChatGPT免费版和Go版引入广告。奥特曼称因多数人想用AI又不付费,只能以此盈利。这背后是模型行业受开源模型冲击,陷入定价困境,开源模型改变了行业预期和估值逻辑。

新智元
产品应用7

长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年

具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。

甲子光年
算法论文8

推出首个「多图应用题」基准GSM8K-V,全面评估 VLM数学推理能力

浙江学团队推出视觉数学推理基准GSM8K-V,将GSM8K映射为视觉对应版本。它数据可靠、覆盖全面,经三阶段构建。实验显示,现有视觉语言模型在视觉推理上短板明显,为模型发展指明方向。

新智元
产品应用8

豆包「打电话」升级 Seeduplex:周围再吵,只认准你的声音

作者分享使用豆包语音通话功能体验,发现它换了新语音模型 Seeduplex。该模型是原生全双工语音模型,解决半双工问题,在复杂场景表现出色,还介绍其技术逻辑及对行业的影响。

特工宇宙
算法论文8

「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!

上海交通学与蚂蚁集团联合团队发布多模态模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。

AI科技评论
产品应用8

让chrome浏览器变成你的智能助手,浏览器转变为强的 AI 控制自动化工具

Chrome MCP Server是基于chrome插件的模型上下文协议服务器,能让模型或chatbot接管浏览器。它有chatbot/模型无关、用原本浏览器等特性,与同类项目比优势明显,还介绍了使用步骤、工具及示例。

GitHubStore
开源动态8

阿里达摩院开源具身脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位