能碳产业大模型」共找到 10434 篇相关文章

新闻资讯8

Mamba一作预告新架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万,Transformer是阶段性最优。几天后将发布新架构,与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
推荐文章7

618想换电脑跑AI?先听我一句劝。

文章围绕618换电脑跑AI展开,分析了本地跑AI的情况,包括不同模型对算力和显存的要求,指出本地跑的好处是隐私安全、无限免费,还推荐了不同预算的笔记本,为想换电脑学AI的人提供参考。

数字生命卡兹克
产品应用8

150PB工业数据+智体革命,西门子开启AI制造新纪元

西门子在工业AI领域成果显著。其工业智体系统贯穿工业脉络,Industrial Copilot提升开发效率。工业基础模型扎根150PB工业数据,与主流大模型路径不同。西门子靠数据和行业know - how构筑护城河。

机器之心
新闻资讯8

2025年4月17日消息,OpenAI 连发o3和o4 mini,o3为强大推理模型,o4-mini专为高效推理优化。它们调用ChatGPT工具,可基于图像思考。OpenAI还开源本地代码智体Codex CLI,兼容所有模型

鱼羊
产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理力的视觉 - 语言 - 行动模型,有核心创新,实验中性显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它反映AI助手长期记忆力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent
开源动态8

ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频

在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可

机器之心
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还利用GPU硬件加速。实验显示其压缩效果显著。

新智元
开源动态8

刚刚,国产AI自己造了AI,全球首例!

面壁智实现全球首例国产AI造AI,用AI编写预训练框架ForgeTrain,性超英伟达Megatron,还训练出MiniCPM5 - 1B模型。该模型可作桌宠,小尺寸高智,还自定义人格,提供工具链。

量子位
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,适应多种部署环境。

AIGC开放社区