新推理模型」共找到 9766 篇相关文章

算法论文8

IEEE TVCG | 告别写代码!MoGraphGPT:基于模块化大模型与图形控制的2D交互场景创作

香港多所高校研究团队提出 MoGraphGPT 系统,结合上下文感知模块化大模型与图形化控制,能让用户零代码搭建 2D 交互场景。该成果被 IEEE TVCG 录用,还对比实验验证其优势。

机器之心
算法论文8

缺数据也能拿SOTA?清华&上海AI Lab破解机器人RL两大瓶颈

现有机器人视觉 - 语言 - 动作(VLA)模型训练范式存在数据采集成本高、泛化能力不足等问题。清华和上海AI Lab团队提出SimpleVLA-RL,解决了VLA模型训练的核心瓶颈,在多基准测试中实现SoTA性能。

量子位
算法论文8

DeepSeek又又又又发论文了!这一次,他们重构了AI看图的方式

DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。

花叔
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理大模型时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理大模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元
开源动态7

GLM-4.7-Flash无审查版发布:30B MoE模型,仅3B激活参数

GLM-4.7-Flash无审查版由HauhauCS发布,基于原版移除审查机制。采用30B - A3B混合专家架构,总参数量31B,每次前向传播仅激活约3B参数,推理快,支持200K上下文长度,有两种变体和四种量化版本。

AI工程化
产品应用8

模型换个Harness就「变笨」?EverMind把自进化从研究推向产品,让AI「越用越聪明」

同一模型换 Harness 表现或大幅波动,暴露自进化走向产品的两个关键问题。EverMind 用 HarnessBank、Raven 与 EverMe 解决,将自进化从研究推向产品,让 AI「越用越聪明」。

机器之心
新闻资讯7

更长的推理链反而导致更多幻觉,MLLMs 幻觉解法仅「抄作业」还不够?摘要

近日,斯坦福等校学者发现,更长推理链会让 MLLMs 产生更强幻觉。MLLMs 幻觉不仅涉及语言偏差,还有跨模态语义失配。主流多模态架构在结构设计和训练机制上的潜在失衡,是幻觉频发的主因。

机器之心
新闻资讯8

谷歌AI里程碑:一个能「做研究」的系统诞生了,用LLM+树搜索编写专家级软件

谷歌提出能帮科研人员编写「专家级」科研软件的AI系统,融合大语言模型和树搜索,可整合重组知识构建思路。在多领域超人类表现,但局限于可量化任务。

机器之心
产品应用8

Meshy用户破千万后杀向战场:ARR年翻14倍,头部厂商集体买单

Meshy是计算机图形学大神胡渊鸣创立的AI 3D公司,其创意工坊打通“AI创意→实体交付”。Meshy生成模型打印适配度高,破圈至多元领域,注册用户破千万,ARR年翻14倍,获多轮融资。

量子位
开源动态7

重磅!中国团队发布SRDA计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?

国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创,为开发者带来高效、低成本等价值。

InfoQ