Qwen3.8-Max」共找到 2595 篇相关文章

开源动态8

百度开源文心4.5系列10款模型,多项评测结果超DeepSeek-V3

今日百度正式开源文心大模型4.5系列10款模型,涵盖不同参数规模。该系列模型在多文本和多模态基准测试达SOTA,多项评测超Qwen3、DeepSeek - V3,还具备三大关键创新,获开发者关注。

Founder Park
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂大模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent
开源动态8

阿里Qwen又悄悄放出8个开源权重,卷疯了~

阿里通义千问太卷,悄悄放出8个开源模型权重,包括体积更小的Qwen3-VL及FP8权重。这一代实现全方位升级,提供两种架构、两个版本,架构也有更新,还给出使用示例与模型权重链接。

PaperAgent
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
算法论文8

ICLR 2026|CMU等团队让AI生成的3D场景真正「站得住」:PAT3D把文生3D从能看推进到能模拟、能交互

现在3D AIGC虽能快速生成场景,但落地有问题,很多场景物理模拟时会暴露物体悬空等问题。CMU等团队提出PAT3D,目标是让生成的3D场景物理上站得住,可用于编辑、交互和仿真,且代码已开源。

机器之心
新闻资讯8

横扫硅谷的千问,杀回国内了

阿里Qwen模型获硅谷认可,Airbnb等公司盛赞。Qwen3 Max在投资大赛夺冠,多模型在各测试表现优异。11月14日阿里推千问APP,金沙江朱啸虎称其为中国ChatGPT,从多维度对比,千问表现出色。

花叔
产品应用8

拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此

阿里推出总参数达1万亿的Qwen3 - Max - Preview (Instruct),比前一代Qwen3(235B)强四倍,发布即上线。官方测评显示它打败Claude Opus 4等对手,实测其编程能力出色,后续正式版值得期待。

量子位
新闻资讯8

干货超标!腾讯混元3D负责人郭春超:真正的3D AIGC革命,还没开始!

腾讯混元团队推出开源项目 Hunyuan 3D 成焦点。腾讯混元 3D 负责人郭春超在 2025 全球机器学习技术大会上表示,真正的 3D AIGC 革命还未开始,分享了 3D 生成现状、挑战及未来等核心洞察。

AI科技大本营
算法论文8

CVPR 2025 Award Candidate | 英伟达等Difix3D+:用单步扩散模型修复 3D 重建伪影

3D重建领域中,NeRF和3DGS在新视角生成时易出现伪影,影响应用。英伟达团队提出Difix3D+,将预训练2D扩散模型用于3D渲染,单步去伪影,效率高、有泛化力,实验效果领先。

机器之心