零跑汽车」共找到 707 篇相关文章

开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
新闻资讯7

分第一,推理暴跌!Claude Opus 4.7上线48小时口碑崩了

Claude Opus 4.7发布48小时口碑两极撕裂。官方榜单并列全球第一,但逻辑推理公开测试成绩暴跌,token消耗涨35%,旧接口报错,用户吐槽「更贵、更蠢、更爱顶嘴」,Anthropic虽解释却难平用户怒火。

新智元
开源动态7

LM Studio宣布支持在Mac上Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化
新闻资讯8

中国科协重磅回击,NeurIPS含金量一夜归!AI顶会已死?

NeurIPS以「合规」为由出台歧视性政策,引发强烈不满。其官方回应遭群嘲,中国科协出手将其2026年在中国学术评价体系中「含金量」归,顶尖学者集体退审,顶会审稿制度也在坍塌。

新智元
推荐文章8

Vibe Coding 方法论:不会编程的人如何用 AI 写出能的代码

文章介绍 Vibe Coding 方法论,即便不会编程,也能用 AI 写出能的代码。核心是把需求说清楚,还可小步迭代开发,Claude 这类会主动询问的工具更适用,同时要明确其适用场景。

宝玉AI
产品应用7

一手实测!不用研究小龙虾了:腾讯搬出QClaw,直连微信,门槛

腾讯基于OpenClaw开源生态推出QClaw,主打简单、门槛部署,可直连主流大语言模型,集成微信能远程操控电脑。还推出SkillHub技能社区,腾讯电脑管家有安全防护功能,但权限问题待解决。

机器之心
开源动态8

他们让万亿参数RL学会了「省着」,顺便砍掉九成算力

2025年,强化学习成大模型进化主战场,但万亿参数模型RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。

量子位
产品应用7

不用花Anthropic API的钱,本地Qwen3.5就能用Claude Code

文章介绍不花Anthropic API的钱,用本地Qwen3.5Claude Code的方法。包括选模型、编译安装llama.cpp、下载量化模型、启动本地服务、配置Claude Code指向本地服务等步骤,还提及踩坑建议和使用方法。

AI工程化
开源动态7

DeepSeek|从构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer
产品应用7

实战指南:从构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server

五一期间作者用MCP架构从实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。

AI大模型应用实践