视觉思维链推理」共找到 2698 篇相关文章

算法论文8

让大模型“吃一堑长一智”,南理工百度等提出模型记忆新方法

南京理工大学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。

量子位
算法论文8

为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述

文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。

阿里云开发者
开源动态8

刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽

2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。

新智元
新闻资讯8

维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据

维纳智能登上Nature通讯,其让大模型自动生成高精度推理数据,用闭环反馈驱动专业Agent自主演化。该公司在多领域交出工业级精度答卷,还解决了Agent泛滥的困局,推出多款创新产品。

机器之心
产品应用8

香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马

一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。

量子位
算法论文8

国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab

现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。

量子位
新闻资讯8

今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力

CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。

新智元
新闻资讯7

奥特曼:假如给我一千倍算力,我会这样做

奥特曼在最新访谈展望下一代模型,认为完美AI是有超人推理能力等的微型模型。理想AGI能自主发现新科学,使全球科学发现提速。他还回应算力假设,为企业指明投入资源方向。

量子位
产品应用8

编码封神,Gemini 2.5 Pro (I/O 版)视频秒转 App!网友:比 o3/Claude 强,Vibe 程序员集结!

谷歌 I/O 大会前,Gemini 2.5 Pro 预览版升级,重点在编码。它搞前端、做 UI 出色,能将视频变互动学习 App,推理速度提升。对标 GPT - 4.1 等,性价比高、表现优,获开发者好评。

AI进修生
算法论文8

刚刚,Anthropic新作:大模型意识被发现了

Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。

PaperAgent