西工大」共找到 5051 篇相关文章

算法论文8

EMNLP2025 | 解耦视觉与推理,港探索视觉语言模型"眼智分离"新范式

当前视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
算法论文8

模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力

空间推理是多模态语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五任务验证其有效。

量子位
新闻资讯8

对话淘宝姜宇宁:如果你只推低价商品,是不需要用语言模型的

淘宝姜宇宁团队上线RecGPT百亿参数推荐模型,对“猜你喜欢”功能技术升级。模型赋予传统推荐系统新能力,如让其“白盒化”、理解长上下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论
算法论文7

你永远叫不醒装睡的模型!多轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估模型在多轮对话中的表现。结果显示,模型在多轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元
新闻资讯7

小米小爱同学:资源受限下,实现端侧模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,探讨模型端侧部署难题。团队自研推理框架,实现180 tokens/s推理速度,采用共享基座架构支持多业务。未来端侧模型突破依赖硬件提升与架构演进。

AI前线
算法论文8

ACL 2026|证据摊开看,场景图画清:让流式视频模型拿捏「何时开口」

随着多模态和语言模型发展,人类与 AI 交互走向共生。现有视频模型难把握响应时机,西北工业学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。

机器之心
产品应用7

昇腾910B模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合模型多卡部署。

探索AGI
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开!北校友立

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升、成本低,性价比高,但也遭质疑,模型下半场或比拼系统架构和智能体工程能力。

新智元
新闻资讯7

Karpathy 秒删 AI 职业分析项目,背后是,一场人类的职业迁移

Karpathy 做了 AI 职业暴露度分析项目,引发关注后秒删。Stanford NLP 指出其分析不足。多家报告显示 AI 对职业冲击,全球科技行业裁员,国内前端岗位受影响,还带来职业迁移。

AGI Hunt
新闻资讯8

云栖会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI