长上下文场景」共找到 2978 篇相关文章

新闻资讯7

对话微分智飞高飞:看具身智能如何引发飞行认知革命 | GAIR 2025

雷峰网第八届GAIR大会邀请微分智飞高飞,探讨具身智能在飞行机器人领域应用。高飞指出其与传统无人机本质区别,介绍应用场景、分布式集群技术,还谈世界模型价值、挑战及创业契机,认为具身智能是历史拐点。

AI科技评论
新闻资讯7

谁押中了「国产GPU四小龙」?

今年10月英伟达因出口管制退出中国市场,国产GPU厂商迎来「上市潮」。「国产GPU四小龙」燧原科技、壁仞科技、摩尔线程和沐曦股份受关注,本文梳理其投资情况,涉及早期伯乐、各方投资意图及上市前景等。

芯师爷
产品应用8

全球首个「导航大脑」上线!一句话让机器人自己找路回家

银河通用联合多所大学发布全球首个跨本体全域环视导航基座大模型NavFoM,让机器人能自主导航。它全场景、多任务、跨本体,重新定义导航逻辑,有技术创新和庞大训练数据,还衍生应用模型推动具身智能商业落地。

新智元
产品应用7

容器可观测新视角: SysOM延时监控助力定位业务抖动原因

云原生场景下,资源超卖和混合部署使宿主机与容器化应用资源竞争加剧,引发内核级延迟问题。本文结合实战案例,介绍用ack - sysom - monitor Exporter分析定位内核延迟,还介绍了SysOM监控及解决系统延时的方法。

阿里云开发者
新闻资讯8

Figure三代机器人发布:洗衣洗碗家务全包!网友:非人形没有出路了

Figure发布第三代人形机器人Figure 03,专为适配Helix AI系统、贴合家庭场景打造。家务表现出色,CEO称无遥控。该公司发展迅猛,融资超10亿美元。Figure 03内外全面升级,为规模化生产设计,引发网友对人形机器人前景热议。

量子位
新闻资讯8

刚刚,英伟达祭出下一代GPU!狂飙百万token巨兽,投1亿爆赚50亿

昨天,英伟达发布专为海量上下文AI打造的CUDA GPU——Rubin CPX,将大模型推理带入「百万Token时代」。它性能强大,能带来高回报,可重写推理经济,还将得到英伟达全栈AI生态支持,预计2026年底可用。

新智元
算法论文8

14B打败671B!微软rStar2-Agent在数学推理上超过DeepSeek-R1

如今的大语言模型推理能力关键在于测试时扩展,但思维链有局限。微软研究团队用主动式强化学习探索,成果 rStar2 - Agent 方法训练出 14B 的 rStar2 - Agent - 14B 模型,性能超 671B 的 DeepSeek - R1。

机器之心
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和

8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和文能力,已在腾讯多业务应用。

InfoQ
推荐文章7

图解Vllm V1系列5:调度器策略(Scheduler)

本文是图解Vllm V1系列5,聚焦调度器策略。先回顾vllm v1整体运作流程,接着阐述调度 - 推理的整体流程,包括将请求添加进Scheduler、Scheduler单步调度策略等,还对比了不同场景下的函数及调度逻辑。

GiantPandaLLM
产品应用8

太逼真!豆包·播客模型来了:一句话生成「苏超联赛」播客,很懂13太保的梗

火山引擎发布豆包·播客模型,生成的AI对话语气、停顿等像真人。操作简单,生成快且有字幕。能处理多种类型内容,如热搜话题、苏超联赛、超文本等。其基于端到端实时语音模型,有技术突破。

量子位