大模型适配」共找到 9236 篇相关文章

开源动态8

国产类脑大模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲模型SpikingBrain (瞬悉)-1.0,借鉴脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑模型生态。

量子位
算法论文8

年度AI论文!全球三顶尖模型的防蒸馏机制全面告破:小模型“套出”模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复模型隐藏思维链数据。还揭示部分模型训练或借鉴模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
新闻资讯7

腾讯混元挖走微软明星模型团队!一作全员出走,新成果已跻身模型竞技场TOP 10

微软明星模型WizardLM一作全员加入腾讯混元,最新成果Hunyuan - Turbos跻身模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内厂正激烈争夺模型人才。

量子位
新闻资讯8

王小川:医疗行业对模型有三刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用模型用于医疗有问题,医疗对模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
算法论文8

模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决模型深度思考的局限,且适配多种模型,性价比高。

AI科技大本营
推荐文章7

模型 Token 究竟是啥:图解模型Token

文章详细解释模型Token概念,指出分词器会把文字切成Token,不同分词器切分结果不同。还介绍分词器的分词方法,通过统计文字出现频率打包成Token并编号,不同模型切分结果有差异。

机器学习AI算法工程
算法论文7

多模态模型理解物理工具吗?PhysToolBench提出了衡量多模态模型对物理工具理解的基准

香港科技学等团队提出 PhysToolBench,用于衡量多模态模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了模型在工具理解上的不足,也为未来发展指明方向。

机器之心
产品应用7

钉钉上跑出的第一个行业专属模型落地:准确率超 90% 的妇科专业模型

近日,壹生检康在钉钉企业专属 AI 平台训练出“豆蔻妇科模型”,准确率达 90.2%。钉钉构建支持体系助企业构建模型,后续还将帮伙伴构建模型和智能体,服务中小企业。

AI前线
开源动态7

数千模型全跑「中国芯」!最后一公里已「焊」通

国产芯片运行模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。它推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与模型应用‘最后一公里’,还举办赛事激发创新活力。

新智元
新闻资讯8

真正面向模型的AI Infra,必须同时懂模型、系统、产业|商汤装置宣善明@MEET2026

商汤装置副总裁宣善明在MEET2026会分享进展,强调模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。

量子位
上一页1 / 924下一页