M5 Pro」共找到 2255 篇相关文章

产品应用8

刚刚,千问App把谷歌和OpenAI的「付费绝活」塞进了手机,还免费?

千问App迎来史诗级更新,接入阿里两大视觉模型Qwen - Image和Wan 2.5。Qwen - Image在图像编辑上有强大视觉逻辑理解和一致性保持能力;Wan 2.5能实现原生音画同步。千问App还实现一站式工作流。

机器之心
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架。

机器之心
新闻资讯7

MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。

Founder Park
产品应用7

AI看病成为医患新包袱?补上「多轮追问」,通用AI才迈得过医疗关

如今患者依赖AI问诊加重医患沟通负担。百川智能推出的Baichuan - M4对通用大模型做结构性重构与医疗专项增强。M4在能力结构上升级,其C端产品百小医能与患者深度建联,有望构建医疗健康新生态。

量子位
新闻资讯7

也许,该庆幸在这个时代被裁员

文章借一位失业者基于AI做产品的感慨,引出对GPT - 5发布的讨论。GPT - 5升级后被中外用户吐槽没人味,OpenAI 24小时内恢复GPT - 4o访问权限,还推出三种响应模式,这引发了对AI与人关系的思考。

MacTalk
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。

开源星探
7

GPT-5两周内发布,内测猛料流出?GPT-6或已开始训练,奥特曼剧透百万GPU

有爆料称GPT-5将在两周内发布,是多模型组成的系统,含「路由器」,GPT-6已在训练。奥特曼称年底将增超百万GPU,有人看好GPT-5,也有人认为它可能只是路由器。此外,OpenAI有十名员工拒小扎3亿天价offer。

新智元
开源动态7

一个Dispatch Dtype引起的fp8 quant kernel性能问题

文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。

GiantPandaLLM
新闻资讯8

王小川:医疗行业对大模型有三大刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗大模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用大模型用于医疗有问题,医疗对大模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
推荐文章7

Learn to Reason _ The way of Baichuan-M1-ClinicReasoning

前百川智能研究小组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。

InfoQ