「多语言优化」共找到 5709 篇相关文章

开源动态8

Mamba 架构实现推理性能超 Gemma3-27B!推理模型开始迈入「无注意力」时代

PromptCoT - Mamba是首个具解码显存常量等特性且推理能力强的模型。当前推理大模型中注意力机制有局限,PromptCoT - Mamba实现无注意力推理,在多评测集超Transformer等模型,为无注意力推理生态奠基。

AI科技评论
产品应用7

Gemini 2.5 Pro 再升级!竞技场分数创新高+思考预算,更强 Kingfall 在路上?

谷歌更新Gemini 2.5 Pro模型预览版,几周后成正式稳定版用于企业级应用。它在多个竞技场分数创新高,编码能力强,还新增“思考预算”功能控成本,价格有竞争力,谷歌还将推更强“Kingfall”。

AI进修生
新闻资讯7

Meta首席科学家LeCun:当前 AI 模型缺乏四项关键人类智能特质

在巴黎AI行动峰会上,Meta首席AI科学家Yann LeCun提出智能四项标准,指当前主流AI系统尤其语言模型在这些方面不足。他认为业界‘组合式’增强是‘功能修补’,介绍Meta‘世界模型’及V-JEPA模型。

力学与人工智能
新闻资讯7

新赋能•创生态 | 首钢园“产业跃升计划”发布会举办

在数字浪潮下,新质生产力成核心变量。5月28日,首钢园“产业跃升计划”发布会召开。其正构建“1+3+X”产业体系,园区已聚800余家科创企业。会上多位专家分享,还签约伙伴构建企业全生命周期服务体系。

首钢园
开源动态8

狂揽20.2k星!还在傻傻的写SQL吗,那你就完了!这款开源项目,让数据分析像聊天一样简单?再见吧SQL

开源项目PandasAI让数据分析像聊天一样简单,由Sinaptik AI团队打造,将ChatGPT级自然语言处理能力注入Pandas。它有对话式分析、智能图表生成等亮点,适用于多场景,还给出使用步骤及与同类工具对比。

小华同学ai
算法论文7

ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍

LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。

深度学习自然语言处理
推荐文章7

MCP for 可观测2.0,6个让MCP开发更高效的小妙招

文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云可观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和可观测2.0+AI未来。

阿里云开发者
新闻资讯7

聊一聊数据中心的投资现状

文章结合多份报告和访谈,分析国外大厂对IDC的态度。微软投资放缓,因资源消化、建设复杂等;OpenAI加速基础设施投入;其他巨头虽强调财务纪律,但核心AI投入未放缓,行业仍处增长早期。

芯师爷
算法论文8

AGI失控率>90%!MIT教授算出「康普顿常数」,AI地球「夺权率」已锁定?

MIT教授研究指出,即使采用理想监督机制,人类成功控制超级智能概率仅52%,全面失控风险超90%。研究通过量化分析提出嵌套可扩展监督等理念,并在四个真实监管场景验证,探讨如何优化现实监管系统。

新智元
开源动态7

用 AI 重新定义 RSS 阅读体验FeedMe

FeedMe可一站式了解多信息源新鲜事,轻量自由且可定制。具备多源RSS聚合、AI摘要生成等功能,支持多种部署方式,如GitHub Pages、Vercel、Docker本地部署,还给出开发指南,项目开源方便Fork和自部署。

GitHubStore