在离线混部」共找到 8177 篇相关文章

新闻资讯8

刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型

xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型真实世界可用性上显著提升,尤其创造力等方面出色。它多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。

机器之心
算法论文8

vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025

AI多模态时代,‘让大模型上手机’成焦点。现有MLLM手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。

量子位
新闻资讯7

Anthropic最新研究:Claude正悄悄进化为“情绪价值大师”

Anthropic研究发现,Claude正成为“情绪价值大师”,人们会面临情感挑战时向其寻求陪伴。它还使用Clio工具分析对话,保护隐私下了解使用情况。Claude情感陪伴与专业支持中扮演双重角色。

量子位
开源动态8

国产MiroMind智能体框架,登顶全球预测未来大模型榜单

国产MiroMind公司全球首个动态实时预测基准FutureX上夺冠,老板是陈天桥。其开源的MiroFlow v0.2智能体框架优势明显,能升级大模型能力,且成本低、可复现。MiroMind预测赛道领先。

AIGC开放社区
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期多赛事表现出色。

AI寒武纪
开源动态7

Qwen拿半成品刷下AIME'25满分,给别人留点面子吧……

开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍训练中,但已AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可Qwen Chat免费试用,API已上线阿里云。

量子位
开源动态7

vLLM Ascend超越MindIE? 昇腾推理Qwen3与DeepSeek R1 Distill性能实测

国内开发者昇腾NPU上进行大模型推理面临挑战,华为MindIE推理引擎使用门槛高。昇腾联合vLLM社区推出vLLM Ascend插件。本文用GPUStack平台实测其与MindIE性能差异,得出两者不同场景各有优势的结论。

AI工程化
新闻资讯8

独家对话比尔·盖茨:AI已跨过临界点,社会却几乎没有讨论

比尔·盖茨与《麻省理工科技评论》的采访中表示,AI多方面已跨过临界点,但行业外缺乏讨论。他警告生物恐怖主义风险,提出‘人类保留岗位’、征税等政策设想,也看好AI部分领域价值。

DeepTech深科技
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其多模型和数据集上性能提升显著。

深度学习自然语言处理
开源动态8

图像界的DeepSeek!12B参数对标GPT-4o,5秒出图,消费级硬件就能玩转编辑生成

Black Forest Labs开源旗舰图像模型FLUX.1 Kontext[dev],专为图像编辑打造,能消费级芯片运行。12B参数少、推理快,性能媲美闭源模型。有诸多特点,经优化训练,KontextBench基准表现优。

量子位