多粒度理解」共找到 4703 篇相关文章

开源动态8

开源 AI 文档生成器!给代码库做个CT扫描,一键生成交互式Wiki文档!

介绍开源工具DeepWiki-Open,它由AsyncFuncAI开发,能将GitHub或GitLab仓库一键转为交互式Wiki,基于种技术实现代码分析和自动化文档生成,解决开发者理解复杂代码库的痛点,还给出快速上手步骤和适用人群等。

开源星探
推荐文章8

11篇顶会论文之外,美图影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
算法论文8

BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026

BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸拓展方向。

AI科技评论
新闻资讯8

火了!刚刚,李飞飞2篇最新文章发布!

AI圈近期被李飞飞两篇重磅文章刷屏,一篇阐述空间智能愿景,指出当前AI缺乏空间智能,其创办的World Labs提出世界模型;另一篇论文揭示当前视频理解基准自欺欺人,还提出新基准VSI - SUPER及预测性感知新范式。

PaperAgent
开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区
开源动态8

腾讯混元AI开源3D世界生成模型!文图即可生成3D沉浸式场景!

腾讯混元AI实验室开源HunyuanWorld 1.0,这是业界首个支持沉浸式、探索性和交互性3D世界生成的全开源模型。它能通过文图生成3D场景,为领域提供支撑,还给出安装和代码使用示例。

开源星探
推荐文章7

LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?

LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。

CourseAI
新闻资讯7

营收67亿、净利8.7亿,这家上海芯片公司再冲刺港股

4月12日,晶晨半导体向港交所主板重新递交H股上市申请,这是其第二次冲击港股。该公司有“硅谷基因、国内运营、全球销售”独特身份,产品覆盖领域,业绩创新高,但也有客户集中、存货激增等风险。

芯师爷
新闻资讯7

Anthropic最新战报:年化收入突破300亿美元,反超OpenAI,千家企业客户单笔年消费超百万

Anthropic宣布与谷歌和博通扩大合作采购算力,首席财务官称是为跟上增长步伐。其年化营收破300亿美元超OpenAI,超千家企业客户单笔年消费超百万,Claude在平台上线,二级市场已重新定价。

AI寒武纪
算法论文8

DeepSeek比你更懂反思!谷歌重磅发现,智能的本质竟是一场社会化对话

谷歌等机构研究发现,像DeepSeek - R1等推理模型思考复杂问题时,内部模拟角色辩论赛,形成思维社会机制,让AI准确率提升,证明智能本质或是内化社会互动,还为调优AI提供新方法。

AIGC开放社区