可迁移模型」共找到 10004 篇相关文章

产品应用8

vivo发布端侧多模态模型,只有3B理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
新闻资讯8

谷歌AGI底座降临!首个原生全模态嵌入模型上线,已实现全模态SOTA

谷歌发布首个原生全模态 Embedding 模型 Gemini Embedding 2,将文本、图、音视频及 PDF 融于统一向量空间,实现跨模态检索,降低架构成本,赋予 AI 连贯「记忆」,是重塑 AI 基建的里程碑。

新智元
推荐文章8

突破泛化瓶颈:阿里云智能运维 Agent 评测体系实践

模型 Agent 在智能运维场景落地常遇泛化难题。阿里云李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其在提升智能运维 Agent 能力上的成效。

InfoQ
新闻资讯7

OpenAI官方GPT-5 提示词泄露:这套“反向Prompt”技巧,让模型听话得像条狗。

GPT5提示词被破解,结合官方《GPT - 5 Prompting Guide》有不少技巧。如Metaprompting让GPT - 5优化Prompt,指导AI编码明确知识、培养自信等,还有控制AI主动性的方法。

探索AGI
新闻资讯8

深度访谈:阿里云X平头哥,模型推理提升13倍背后的秘密

这篇深度访谈聚焦阿里云与平头哥,探讨模型推理提升13倍背后的秘密。随着AI焦点转向推理,行业面临算力、成本、监管等矛盾。嘉宾分析推理范式现状与变化,探讨推理加速技术及优化策略,还谈及瓶颈、未来发展及竞争方向。

InfoQ
新闻资讯8

模型记忆系统 MemOS 2.0:StarDust 技术演进与关键挑战|QCon 北京

4月16 - 18日QCon北京大会聚焦Agentic AI等前沿话题,记忆张量CTO李志宇将分享《大模型记忆系统MemOS 2.0:StarDust技术演进与关键挑战》,梳理技术演进,推出MemOS 2.0 StarDust,还分析实践痛点与演讲亮点。

InfoQ
算法论文8

迎接范式革命:最新、最全的大模型Latent Space综述,NUS、复旦、清华等联合出品

模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五大视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
新闻资讯7

爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰

谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。

新智元
算法论文8

基础模型已颠覆科研,进入第五范式!港科大综述113篇论文 | NeurIPS'25

港科大论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,能引领科学进入第五范式,但也面临偏见、幻觉等问题。

新智元
算法论文8

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

视觉规划里世界模型‘想象’过程慢,西安交通大学研究团队提出Fast LeWorldModel,从根本改变预测方式,实验显示其提升了成功率,还大幅缩短规划时间。

机器之心