Qwen3-1.7B」共找到 3822 篇相关文章

新闻资讯8

Jason Wei也被小扎带走:思维链开创者、o1系列奠基人!这次真挖到OpenAI大动脉了

思维链提出者、o1系列模型关键人物Jason Wei被曝将入职Meta,o1另一位关键人物Hyung Won Chung也可能被挖走。小扎为顶尖AI人才提供强大支持,而OpenAI内部也存在增长混乱等问题。

量子位
开源动态8

GitHub 8k star!AI Gateway 如何帮你3行代码接入1600+ LLM,实现成本、可靠性与安全三赢?

Portkey AI Gateway是面向生产环境的开源AI Gateway,支持超1600款模型,通过1个API接口实现快速、可靠、安全的模型路由。它能解决产品开发和使用中的痛点,有统一API接口等核心功能。

小华同学ai
新闻资讯7

暴走东京电玩展,Game Show也AI上了

东京电玩展上,网易、腾讯等中国游戏厂商摆大展台,AI厂商也秀出肌肉。阿里展出通义千问和通义万相,拿出大模型商用化方案;3D生成受关注,混元3D、VAST Tripo等受游戏厂商青睐;AI陪玩HakkoAI海外首秀成绩亮眼。

量子位
算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

一项新研究表明,7B小模型LoopCoder v2在正常计算外多循环一次,就能在SWE - bench Verified基准上大幅提分。继续增加循环次数,性能反而下降。研究还算了‘收益 - 成本’账,给出选择循环次数的诊断方法。

AIGC开放社区
新闻资讯7

最强人才接连被挖,创业大佬离开 OpenAI 后说了实话:7 周硬扛出 Codex,无统一路线、全靠小团队猛冲

近日,OpenAI 研究员 Jason Wei 即将加盟 Meta 新成立的超级智能实验室,另一位研究员 Hyung Won Chung 也将一同加入。此外,曾参与 Codex 开发的创业大佬 Calvin French - Owen 分享在 OpenAI 的经历,揭示其内部生态。

AI前线
算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位
新闻资讯8

382人、平均95后,MiniMax百亿估值冲刺IPO!招股书首次披露业绩:研发成本仅为OpenAI的1%、收入猛增8倍

12月21日,通用人工智能公司MiniMax通过港交所上市聆讯。其员工年轻,研发成本仅为OpenAI的1%,收入猛增,产品覆盖多模态。此次聆讯或倒逼行业转向“经营叙事”,加速行业分化。

AI前线
8

382人、平均95后,MiniMax百亿估值冲刺IPO!招股书首次披露业绩:研发成本仅为OpenAI的1%、收入猛增8倍

12月21日,MiniMax通过港交所上市聆讯。该公司员工年轻,创始人背景强。其发布多模型,产品覆盖多场景。研发成本仅OpenAI的1%,营收增长快,付费用户多,上市或促进行业转向“经营叙事”。

InfoQ
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.27B参数硬刚思维链模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参数AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维链模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
新闻资讯8

真够卷的!DeepSeek更完智谱更:GLM-4.6,代码国内最强

前脚DeepSeek更新到V3.2,智谱又推出GLM-4.6,代码能力达国内最强。测试显示其在多方面表现出色,还降低平均token消耗。寒武纪、摩尔线程跟进适配,价格也降低。

量子位