Qwen3-Max-Thinking」共找到 624 篇相关文章

开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
新闻资讯8

黄仁勋砸千亿兆瓦算力,押注下一个“Open AI”

3月10日,前OpenAI高管Mira Murati创办的Thinking Machines Lab与英伟达达成长期合作,英伟达将提供1吉瓦下一代NVIDIA Vera Rubin系统。这一合作规模巨大,显示英伟达全面布局,也体现该创业公司野心,不过其面临组织动荡考验。

AI前线
新闻资讯7

Mira翁荔陈丹琦公司,让老黄掏出了600亿美金

Thinking Machines Lab官宣与英伟达达成新一轮合作,将落地预计成本600亿美元的1GW规模数据中心,含英伟达现金注资。此前英伟达已参与其种子轮融资助其达120亿美元估值,现公司估值达500亿美元。

量子位
算法论文8

总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。

AIGC开放社区
新闻资讯8

中国模型打服硅谷:Airbnb联创CEO感叹又快又好又便宜!把ChatGPT合作都拒了

当OpenAI为ChatGPT造势时,中国模型凭实力圈粉老外。爱彼迎CEO称依赖阿里Qwen,因其又好又快又便宜;Kimi K2性能碾压闭源模型;DeepSeek创新成果获多方称赞,中国模型在全球AI竞赛中走出独特路径。

量子位
新闻资讯7

种子轮就估值120亿美元,她能打造另一个OpenAI吗?

据《金融时报》,OpenAI前CTO Mira Murati的创业公司Thinking Machines Lab种子轮融资20亿美元,投后估值120亿美元。此轮由a16z领投,Nvidia和AMD参投。Murati透露公司方向,还称产品含开源组件。

机器之心
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent
推荐文章7

Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)

文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。

AINLPer
新闻资讯7

Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车

Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。

AI科技评论
推荐文章7

AutoResearch-LLM:让 Agent 接手 LLM 训练优化

本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。

阿里云开发者