点云视觉」共找到 1838 篇相关文章

开源动态8

极客大神构建了LLM架构画廊,AI大神Karpathy

极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。

AIGC开放社区
新闻资讯7

阿里容器服务覆盖AI全流程,团队透露:OpenAI训练GPT时就用了我们的开源能力

拿下中国AI市场第一后,阿里技术产品负责人开展AI Infra分享会。其全栈计算搭好技术架子,10万GPU集群高效互联,容器服务贯穿AI全流程,还透露OpenAI训练GPT时用了其开源能力。

量子位
产品应用8

95% 企业 AI 投资无回报?华为 × 合力亿捷:客服 Agent 给出解题思路

麻省理工报告显示 95% 企业生成式 AI 投资无回报,但指出办公自动化等领域回报率高。客服 AI Agent 是热门方向,华为与合力亿捷合作的方案解决行业痛,打通数据闭环,有示范意义。

InfoQ
算法论文8

AAAI 2026 | 北航、东京大学填补AI「语义鸿沟」,过程感知视频理解如何找到「状态」锚

北航陆峰教授团队联合东京大学,提出视频理解新框架 TSS,引入“状态”作视觉,解决抽象文本指令与具象视频对齐难题,已被 AAAI 2026 接收,代码已开源。

机器之心
新闻资讯8

干货满载!腾讯AI技术周圆满收官,回顾如何利用AI增效创收

2025腾讯全球数字生态大会启幕前夕,腾讯联合InfoQ打造「AI技术周」,9月8 - 14日直播输出,围绕多关键议题邀大咖对话,公布多项AI+产品进展,涵盖降成本搭应用、AI Agent落地、数据库智能进化等内容。

InfoQ
新闻资讯8

阿里秘密武器亮相顶会:狂砍82%英伟达含量,213块GPU干了1192块的活

阿里与北大合作,由CTO周靖人带队的研究提出GPU池化系统Aegaeon,亮相顶会SOSP。它用token级自动扩缩容技术,将GPU使用量从1192个减到213个,提升了资源利用率,还在百炼平台测试成功。

量子位
算法论文8

AI 会笑吗?BIGAI & 上交大团队:多模态大模型是否真的能 get 到视频笑|ACL 2026

上海交通大学等团队构建v-HUB评测基准,分析多模态大模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
算法论文8

大模型时代,通用视觉模型将何去何从?

过去通用视觉模型(VGM)是研究热,想实现‘视觉模型大一统’。但大语言模型发展使研究热转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。

机器之心
算法论文8

视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL

数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。

PaperAgent
算法论文8

苹果传统强项再发力,视觉领域三种模态终于统一

苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。

机器之心