推理部署」共找到 2639 篇相关文章

算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
推荐文章8

第一章:AI 技术前沿全景

文章聚焦AI Agent技术前沿,阐述大语言模型三次能力跃迁,从涌现能力到对齐指令遵循,再到推理与行动。还提及Scaling Law变化,推理时计算扩展更划算,介绍代表性推理方案及多模态融合,指出Agent打破传统对话AI局限。

CourseAI
开源动态8

猛涨25k star!一键检测你的电脑能跑哪些大模型!

最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断大模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。

开源先锋
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
新闻资讯8

今天,OpenAI杀疯了!砸40亿美元成立新公司、还祭出网络防御利器Daybreak

OpenAI宣布推出OpenAI部署公司,获超40亿美元初始投资,还收购Tomoro。其将派工程师嵌入企业,帮构建部署AI。同时推出网络防御AI Daybreak,可加速防御、保障软件安全。

机器之心
开源动态7

DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer
产品应用8

Qwen3-Max-Thinking:会想能干,比强更强

正式推出旗舰推理模型 Qwen3 - Max - Thinking,其在多关键维度显著提升,性能媲美顶尖模型。引入自适应工具调用和测试时扩展技术,现已上线 Qwen Chat,API 也开放,还介绍了使用方法。

千问Qwen
新闻资讯7

OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark

OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。

AI寒武纪
新闻资讯8

数据中心不必建在地球!中国企业已经把算力设施送到了太空

国星宇航牵头“星算”计划,首发星座发射成功,将开启全球“太空计算时代”。太空部署算力可节约能源成本、及时处理数据且更安全,未来将与地面“天地协同”,中国在此领域走在前列。

量子位
新闻资讯8

DeepSeek、智谱被曝造芯,国产大模型绕开英伟达!

据路透社等爆料,DeepSeek与智谱AI正秘密自研定制化AI芯片,目标是摆脱对英伟达等的硬件依赖,构建自身算力生态。因算力账本和外部环境压力,两家公司选择研发面向推理场景的芯片。

新智元