多语言模型」共找到 9739 篇相关文章

新闻资讯7

狂拿大模型明星订单,一家清华系HPC-AI Infra公司浮出水面

本文介绍清华系计算创业公司是石科技,其93年创始人闫博文不囤算力仍拿下大模型明星公司订单。团队技术实力强,3次获戈登·贝尔奖。公司构建全栈能力,为领域提供服务,未来想以算力赋能各行业。

量子位
推荐文章7

精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事

文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型

腾讯技术工程
推荐文章7

24小时快速入门大热语言Rust!学不会来找我

文章从Rust核心语法等基础入手,介绍其不同于其它语言的思维方式,还通过实战项目带读者入门。阐述了安装、工具使用,用greplite小程序介绍语言特点,讲解组织数据方式、所有权等,最后实现mini - redis并给出学习建议。

腾讯技术工程
算法论文8

强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”

在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等方面表现出色。

机器之心
开源动态8

谷歌开源非结构化数据抽取工具

谷歌开源 Python 库 LangExtract,用 LLM 从非结构化文本文档提取结构化信息。它定位精确、输出可靠,针对长文档优化,有交互式可视化,支持模型,适应领域,还给出快速开始示例。

GitHubStore
开源动态8

不止于快!美团新推理模型正在重新定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
开源动态8

小米陈龙团队首作:统一具身与自动驾驶的开源模型

小米具身智能团队发布首篇论文,提出统一具身智能与自动驾驶的新模型MiMo-Embodied。该模型任务中领先,其四阶段训练框架打通两领域边界,为行业提供新范式。

AI科技评论
开源动态8

谷歌版小钢炮开源!0.27B大模型,4个注意力头,专为终端而生

谷歌开源Gemma 3 270M,几分钟就能完成微调,性能超Qwen 2.5同级模型。此模型小巧高效,可本地运行,还能用它构建OCR应用。它有项亮点,适合场景,上手简单。

量子位
新闻资讯8

刚刚,智源全新「悟界」系列大模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源大会,智源研究院推出全新「悟界」系列大模型,含原生模态世界模型Emu3、脑科学模态通用基础模型见微Brainμ等,反映其对大模型发展的研判,推动AI向物理世界迈进。

机器之心
推荐文章8

面向工具任务调度的两种路径:MCP vs Agent + Function call

本文围绕大语言模型智能应用中的工具与数据接入问题,介绍了基于 Agent + Function Call 的动态调度机制与基于 MCP 的标准化接入框架,分析了不同场景下的适用性,还探讨了二者未来的协同融合方向。

阿里云开发者