Qwen2-7B-Instruct」共找到 2166 篇相关文章

新闻资讯7

太炸了!小扎2亿美金挖走了庞若鸣,比库克年薪还高

外媒爆料小扎花2亿美金挖走苹果智能基础模型负责人庞若鸣,薪酬比库克高,且大部分与绩效挂钩。庞若鸣履历出色,领导苹果自研大模型核心团队,成果关乎苹果产品未来。

AI寒武纪
产品应用8

“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感

5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型。

AI科技大本营
开源动态7

Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。

AI科技评论
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化
开源动态8

SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用

Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交大推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。

深度学习自然语言处理
新闻资讯7

这个扩散LLM太快了!没有「请稍后」,实测倍速于Gemini 2.5 Flash

AI初创公司Inception Labs推出首款专为聊天定制的商业级扩散LLM——Mercury。它速度超快、效率高,能实时响应对话。实测显示其速度优于Gemini 2.5 Flash等,不过生成质量有待提升。

机器之心
产品应用8

阿里 Qwen3-TTS 两大更新直接封神!支持跨物种音色克隆,3 秒复刻!

阿里通义上线 Qwen3-TTS 两大核心能力,VoiceDesign 支持全文本控制音色特征,VoiceClone 能 3 秒音频跨语言、跨物种克隆音色。更新指标亮眼,如 0.1 秒级生成速度等,还可上手体验。

开源星探
开源动态8

开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一

中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。

AIGC开放社区
产品应用8

1/10成本、Opus 4.7级表现,Cursor甩出了性价比之王Composer 2.5

Cursor推出新模型Composer 2.5,成本仅为Claude Opus 4.7的1/10,性能几乎追平。它更智能,擅长处理长时任务,遵循复杂指令更可靠。未来一周使用额度翻倍,还宣布与SpaceXAI合作训练新模型。

机器之心
推荐文章8

2026 年,万物皆 Coding Agent 的平台工程新范式(A2A / ACP / MCP / Skill)

过去 DevOps 工具链复杂,如今 AI 重塑其为 Coding Agent。借助 A2A、ACP、MCP 和 Skill,可构建 Agent 网络。文章分析平台工程演进,介绍相关协议,对比编排模式,还给出 Routa 编排架构实践参考。

phodal