混合推理方案」共找到 2919 篇相关文章

算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
开源动态8

国产双开源:让Mac成为你的私人AI工作站

2026年3月底,Ollama将Mac版底层推理引擎换为苹果MLX框架,性能提升显著。明略科技开源Cider和Mano - P,Cider加速推理,Mano - P可操作图形界面,两者结合推动Private AI发展。

机器之心
开源动态8

一夜颠覆Sora神话,H200单卡5秒出片!全华人团队开源AI引爆视频圈

UCSD等机构发布FastWan系模型,用「稀疏蒸馏」训练方案,让视频去噪速度飙升70倍。FastWan在单张H200上5秒生成480p视频,模型权重等全开源,改写AI视频生成格局。

新智元
新闻资讯8

黄仁勋CES2026最新演讲:三个关键话题,一台“芯片怪兽”

北京时间1月6日,英伟达CEO黄仁勋在CES2026演讲。回顾过去一年开源模型发展,本次围绕系统与基础设施、模型、应用落地三条主线演讲,展示Rubin架构等成果,推动推理型AI发展及应用。

芯师爷
新闻资讯8

首次,AI下棋不再是「黑盒」!

上海AI Lab发布升级版大模型「书生·思客InternThinker」,首度打破围棋AI推理黑盒,能用自然语言解释落子逻辑,具备职业3 - 5段棋力。依托创新训练平台InternBootcamp,它在多任务表现出色,且相关技术有系列创新突破。

新智元
算法论文8

Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平

香港科技大学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型大小’更重要。

机器之心
开源动态7

Mem0,用LLM给智能体解决记忆问题,开源

大模型训练后知识和记忆不再增加,智能体记忆能力发展不理想。国外Mem0针对AI记忆技术发表论文并开源,提出Mem0和Mem0g两种方案,在不同场景表现出色,已获多应用,还提供SaaS服务。

AI与安全
算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
新闻资讯7

大模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理

Founder Park
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。

机器之心