多模型协作」共找到 9848 篇相关文章

产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月大模型厂商上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。

机器之心
算法论文8

模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等方面内容。

机器之心
开源动态8

300个AI员工,跑满4000步不崩,Kimi新一代模型K2.6来了

月之暗面开源发布 Kimi K2.6 模型,在通用智能体、代码编写和视觉理解等综合能力上全面跃升。它在项测试成绩领先,能连续工作13小时,还在全栈开发、智能体协作等方面有出色表现。

AIGC开放社区
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在领域表现出色,但二者也都存在安全风险。

AIGC开放社区
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强模态模型

本周五凌晨,谷歌正式发布、开源全新端侧模态大模型 Gemma 3n。它有模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在方面实现质量提升。

机器之心
算法论文8

华为攻克AI推理「想太」问题!新方法让大模型推理提速60%,准确率还高了

华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在个推理benchmark测评中表现出色。

量子位
开源动态8

华为开源7B模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了

华为推出开源模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。

量子位
开源动态8

6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!

在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持模型服务器,提供安全机制,适配网页浏览、3D建模等种场景,降低AI Agent开发门槛。

开源星探
新闻资讯7

时隔9个月Meta全新模型Muse Spark发布:闭源,原生模态,一发布就落后?

时隔9个月,Meta推出Muse家族首款大模型Muse Spark,原生模态推理,但能力表现一般,编程领域落后于opus 4.6和GPT 5.4等。它有沉思模式,致力于成个人超级智能,技术亮点,性能高效。

AI寒武纪
开源动态8

VinciCoder:模态统一代码生成框架和视觉反馈强化学习,数据代码模型权重已开源

中科院与美团团队推出 VinciCoder,打破模态代码生成中 SFT 范式瓶颈。它将奖励机制转向视觉域,通过两阶段策略统一样化代码生成任务,在基准测试中表现卓越,为领域研究提供新范式。

机器之心