「大算力芯片」共找到 5893 篇相关文章
大模型下半场,阶跃凭什么领跑多模态之战
国内大模型竞争分资源派、技术派、国家队三阵营,多模态成竞争分水岭。阶跃星辰成立两年发22款自研基座模型,16款为多模态。其坚持理解生成一体化路线,在多模态领域有优势,还布局多应用场景。
人类记忆 vs 大模型记忆,到底差在哪?
这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
整整21个月,豆包大模型正式进入2.0时代!
时隔21个月,豆包大模型2.0正式推出。它在多模态理解、企业级Agent、推理和代码能力上有提升,在多个基准测评中达业界最优。实测显示其在编程、数学问题处理上性能出色,性价比也具优势。
Google说,2026年AI Agent会有这五大趋势!
Google Cloud发布2026年Agent趋势报告,认为能改变业务的转折点是Agentic AI,总结了五大趋势,如人人都有Agent、流程自动化等,核心是让员工成Agent管理者和协调者。
PAS刊发西工大张伟伟教授智能流体力学重磅综述论文
西工大张伟伟教授团队受主编邀请,系统调研人工智能与流体力学交叉领域进展。通过科学计量学方法,展示发展脉络、现状与前沿方向,分析研究格局、梳理团队,为该领域提供全景图。
模型压缩与量化:让大模型走向轻量化落地
文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。
大模型评估排障指南 | 关于 LaTeX 公式解析
这是大模型评估排障指南系列第二篇,聚焦 LaTeX 公式解析。评估难点是解析和比较模型输出与标准答案,无标准方法。lm - evaluation 框架用 sympy 解析准确率约 0.94,还给出缓解问题办法。
旧手机除了放转转,还能放数据中心提供算力
Google和UC San Diego合作,将退役Pixel手机拆解成主板组成计算集群,跑教学科研任务。研究表明,旧手机算力仍有价值,可用于轻量任务,还能降低隐含碳,或催生新产业链。
英伟达50亿美元入股英特尔,将发布CPU+GPU合体芯片,大结局来了?
9月18日英伟达与英特尔宣布达成合作,英伟达投资50亿美元购其股份。双方将合作开发多代定制数据中心和PC产品,包括定制CPU、集成RTX GPU的x86 SoC等,此前二者有竞争历史。