动态建模」共找到 600 篇相关文章

推荐文章8

万字长文!大模型(LLM)推理优化技术总结(非常详细)

文章聚焦大模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。

AINLPer
开源动态8

上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下

上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能力。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。

量子位
开源动态8

突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!

在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。

开源星探
算法论文7

ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍

LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。

深度学习自然语言处理
算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。

深度学习自然语言处理
产品应用7

6个Claude Code神作,Anthropic亲选

Claude 官方晒出一批来自普通用户的 Claude Code 「神作」,覆盖实用工具、可视化创意和趣味应用等领域,如人脸涂鸦、医学影像查看器、代码库动态图等。这些项目反映出 Claude Code 正走出传统编程场景。

机器之心
新闻资讯8

对话罗剑岚:机器人必须在真实世界中持续变强

DeepTech对话智元机器人首席科学家罗剑岚,围绕其团队发布的机器人世界模型τ0 - WM展开。罗剑岚认为机器人不能只在静态数据集上模仿,要能预测动作后果,还探讨了数据作用、工作关系及开源意义等。

DeepTech深科技
新闻资讯8

凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了

4月29日凌晨,OpenAI与亚马逊云科技联合发布多个新动态,如OpenAI旗舰模型进Bedrock预览、Amazon Bedrock Managed Agents预览等。双方合作让Agent有持久化记忆,还推出多项产品,亚马逊云科技成MaaS一极。

InfoQ
产品应用7

陪5岁小朋友玩到黔驴技穷,我用一张照片给他做了个汪汪队手办。

作者陪5岁小朋友玩时,用一张照片结合Hi3D网页和3D打印技术做汪汪队手办。介绍了3D建模、格式选择、代加工等全流程,还分享了成本控制和上色等经验。

探索AGI
新闻资讯7

一家00后创办的世界模型公司,凭什么让华为哈勃重金押注?

近日,00后创办的魔芯科技完成Pre - A +轮近亿元融资,由华为哈勃领投。该公司从3D AI物体建模出发,研究独特技术路线,在科研和产品应用有突破,正将能力落地多领域。

机器之心