「Qwen3 - 30A3B - Instruct」共找到 698 篇相关文章
卡内基梅隆大学开源LegoGPT,用AI设计乐高模型
卡内基梅隆大学开源LegoGPT,可依文本提示生成物理乐高模型。它把乐高设计转为自回归文本生成任务,基于LLaMA - 3.2 - 1B - Instruct微调,应用场景广泛,如教育、玩具设计等。
拉 DeepSeek 和通义“组队”斗 OpenAI?小扎首届 AI 大会变“大型商战现场”,和微软 CEO 疯狂互曝!
4月30日凌晨Meta举办首届AI开发者大会LlamaCon,推出面向消费者的Meta AI聊天机器人和面向开发者的Llama API,欲扩大开源Llama模型应用范围、挑战OpenAI。扎克伯格还与微软CEO纳德拉就开源闭源生态、AI生产力等展开讨论。
刚刚,GPT-5.5 Instant全员免费!数亿人的ChatGPT变了
OpenAI深夜推出GPT - 5.5 Instant,全面接管ChatGPT默认模型且全员免费。它亮点诸多,如幻觉率暴降、数学成绩提升、回复字数减少、记忆和个性化功能升级等,三个月后GPT - 5.3将退役。
苹果疯狂狙击Vibe Coding App
苹果在App Store对多款Vibe Coding应用采取限制措施,阻止更新、下架产品。苹果称是因应用绕过审核机制,存在安全风险,但开发者质疑其动机,背后或有商业利益考量,网友也吐槽苹果政策陈旧。
OpenClaw 闭门局:和 30 位创业者一起聊聊,真正值得关注的 Agent 生态位在哪?
OpenClaw带火了Agent,带来整个Agent生态重建机会。在第四期AI产品市集Meetup上,30多位创业者探讨创业机会,涉及Token消耗、支付、硬件、记忆等方面,还讨论了创业策略。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
阿里正式批准林俊旸辞职!将成立基础模型支持小组、坚持开源、加大人才投入
Qwen负责人林俊旸突然离职引发关注,阿里官方回应,CEO吴泳铭在内部邮件中称已批准其辞职,还将成立基础模型支持小组,坚持开源策略,加大AI研发及人才投入。
来自MiniMax M2.5的震撼 :小尺寸几乎打平opus4.6,巨便宜,巨能干活,速度巨快
MiniMax M2.5正式发布,是优秀国产模型。它专注极致优化,部署方便、价格实惠、性能顶尖。在多项基准测试表现出色,速度提升、成本降低,多维度实现突破,已在MiniMax Agent全面部署。
刚刚,苹果官宣iphone搭载最强AI,每年给Google 10亿,不愿在信ChatGPT。
早上苹果与Google官宣的新闻刷屏,下一代苹果基础模型将基于Gemini构建。苹果因自研来不及且人才流失,选择花10亿买Google模型。还分析了未选OpenAI的原因,以及隐私方面的问题。
性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准
NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。