B30」共找到 1045 篇相关文章

开源动态7

从GPT-2到gpt-oss,深度详解OpenAI开放模型的进化之路

OpenAI 近日发布 gpt-oss-120b 和 gpt-oss-20b 两个开源模型,Sebastian Raschka 发布博客对其详细分析,回顾自 GPT - 2 以来 AI 社区进步,还与 Qwen 3 比较,介绍架构、训练、推理等细节。

机器之心
算法论文8

性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令

现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。

量子位
新闻资讯7

OpenAI偷袭,谷歌掀桌!2026开年第一场AI大战太精彩

OpenAI悄悄上线ChatGPT Translate挑战谷歌翻译,该工具支持超50种语言,有翻译后「二次加工」能力,但功能尚不完善。谷歌则高调开源TranslateGemma模型,支持55种语言,效率惊人,12B参数超越27B基线。

新智元
算法论文8

模型汤新做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷新SoTA!

大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。

AINLPer
开源动态7

The Batch: 882 | Qwen3-Next 提速

阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。

DeeplearningAI
产品应用7

用 Ollama 本地运行 OpenAI gpt-oss 官方完整教程

OpenAI出教程教用Ollama本地部署gpt-oss-20b或gpt-oss-120b,可实现离线对话、API调用等。介绍模型版本、硬件要求、安装设置,还提及对话、API使用、工具调用、与Agents SDK集成等内容。

AI工程化
产品应用7

怎么从 ChatGPT 拿流量?送上这九条实用建议

文章指出AI问答引擎成B2B采购决策重要‘守门人’,介绍问答引擎优化(AEO)概念,还通过采访提炼九条从ChatGPT等拿流量的实用建议,如明确提问场景、了解平台差异等。

Founder Park
开源动态8

国产AI拿下国际物理奥赛金牌,13项顶级竞赛豪取12金1银,划重点:开源

上海人工智能实验室团队推出开源模型家族P1,在IPhO 2025理论考试中,P1-235B-A22B成首个达金牌线的开源模型。引入PhysicsMinions后成绩提升,在HiPhO基准排名第一,且全链路开源。

量子位
开源动态8

刚刚,美团开源全模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分

美团发布开源全模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正全模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。

AGI Hunt
8

企业落地 NL2SQL,需要的是 AI-ready data 和 小模型

当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程化流程’。文章指出先数据后模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程化路径等内容。

InfoQ