大模型智能体」共找到 10694 篇相关文章

算法论文7

李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了

本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。

机器之心
新闻资讯7

热议!DeepSeek V3.1惊现神秘「极」字Bug,模型故障了?

DeepSeek 最新的 V3.1 模型上线不到一周,因离奇 Bug 引发社区热议。无论执行何种任务,模型总会在文本中插入「极」字,自我修复时也无法避免,还存在多语言混用问题,网友猜测原因多为「数据污染」。

机器之心
算法论文8

Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平

香港科技学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型小’更重要。

机器之心
新闻资讯7

全国首部AI智能体应用评估标准,现公开征集起草单位和个人!

2025年成AI智能体元年,市场规模将达113亿美元,但企业部署面临‘效能黑箱’。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,填补评估空白,现公开征集起草单位和个人。

PaperAgent
新闻资讯7

全国首部AI智能体应用评估标准,现公开征集起草单位和个人!

2025年成AI智能体元年,市场规模将达113亿美元。但企业部署时面临‘效能黑箱’,缺乏评估规范。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现征集起草单位和个人。

AI工程化
开源动态8

无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab

多图像、长视频让型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性能的前提下实现推理加速,且已在GitHub开源。

量子位
开源动态8

首个多模态工业信号基座模型FISHER,权重已开源,来自清华&上交等

清华、上交等团队联合发布首个多模态工业信号基座模型 FISHER,用搭积木法对异质工业信号统一建模。技术报告和权重已开源,还提出 RMIS 基准评估性能,实验显示其泛化能力强。

机器之心
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
新闻资讯7

2025 AI赋能流体力学国际研讨会暨第五届全国智能流体力学研讨会于香港顺利召开

2025年11月29日至12月1日,2025 AI赋能流体力学国际研讨会暨第五届全国智能流体力学研讨会在香港理工学举行。会议汇聚全球专家,设3个主题分会场,还组织圆桌研讨,推动了智能流体力学发展。

力学与人工智能
新闻资讯7

全国首部AI智能体应用评估标准,现公开征集起草单位和个人!

AI智能体正从辅助向自主决策进化,但企业因缺乏评估规范,面临选型、验收、优化难题。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,公开征集起草单位和个人。

开源星探