「Qwen3 - 30A3B - Instruct」共找到 698 篇相关文章
斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4
斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。
【博客翻译】使用PyTorch加速生成式AI第四部分:Seamless M4T,快速优化
这是使用纯原生PyTorch加速生成式AI模型系列博客的第四部分,专注加速FAIR的Seamless M4T - v2模型。通过torch.compile + CUDA Graph,在不损失精度下实现text decoder模块2倍、vocoder模块30倍加速,端到端推理2.7倍加速。
HF Papers 直播| AI for Science 专场
由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第三场聚焦AI for Science,将于2025年7月17日19:30 - 21:30开始。邀请多位热门论文作者,探讨科研智能体能力评估等问题。
明晚直播|从《黑客帝国》到迪士尼乐园:谈《拟像与拟真》
法国后现代思想大师让·波德里亚在《拟像与拟真》中预警数字时代图景。2025年12月5日19:30—21:30,豆瓣读书联合南大社·守望者邀汪民安等嘉宾,结合电影探讨波德里亚思想及拟像,直播在豆瓣读书视频号同步。
当 Agent 走出 App:WorkBuddy 的朋友圈开始向外生长
9月2日深圳的WorkBuddy生态发布会,展示9款联名硬件,有30多个硬件品牌、30多个Buddy应用、100多个开放平台共创伙伴参与。WorkBuddy开放Agent能力,连接伙伴资源,解决数据和专业经验难题,开放硬件、应用与平台三层,但面临价值分配等问题。
华为盘古大模型:被芯片牵制的“千古”模型
华为盘古大模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.5的14b等,导致人才流失。
面向 SGLang 的 Profile Analysis SKILL:3 张表定位 Kernel Fuse 和 Overlap 机会
文章介绍了面向SGLang的Profile Analysis SKILL,其工作流统一,输出3张表定位Kernel Fuse和Overlap机会,支持多种分析方式和模型。还给出Qwen/Qwen3.5 - 4B和openai/gpt - oss - 20b的分析结果,并表明该SKILL能节省token、缩短工期,作者厌恶Torch Compile。
AI 圈现“教科书式”骗局:对外伪造千亿估值,对内裁员、四次爽约,投资人员工双双被套
2025年初,Infinite Reality宣布获30亿美元融资,自报估值飙升至155亿美元,引发质疑。其高估值存疑,30亿美元融资真实性未知,CEO履历也有疑点。11月股东会称33.6亿美元投资或不到账,还取消股份回购,已四次食言,目前遭监管调查。
OpenAI开源Privacy Filter:PII检测不用传服务器 Apache2.0可商用
OpenAI开源Privacy Filter模型,采用Apache2.0协议可免费商用。它是PII检测工具,支持全本地运行,避免数据泄露。有诸多技术亮点,也有一定局限性,上线后下载量可观。
突发!OpenAI收购失败,windsurf被谷歌一锅端
原定OpenAI收购AI编程初创公司Windsurf交易取消,其CEO等核心人员转投谷歌DeepMind,围绕Gemini研究“代理编码”。谷歌是“人才聘用”,获部分技术非排他许可,Windsurf继续运营。