在离线混部」共找到 8190 篇相关文章

产品应用8

阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了

阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet合注意力机制。有原生多模态设计,解决“内存墙”问题。多基准测试中表现出色,开发者反响好,但也存幻觉级联、调试局限等问题。

AI工程化
开源动态8

不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

英伟达联合多机构推出TTT - E2E方法,长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。

量子位
开源动态8

蚂蚁C2LLM:基于注意力池化的代码检索新范式

Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。

PaperAgent
产品应用7

夸克“搜聊一体”新模式,难掩中国版ChatGPT的野心

夸克“C计划”首个落地项目对话助手引发热议。体验发现,它能完成复杂问答,还可用于图文识别、AI写作等场景。回答逻辑性、辅助学习、理解模糊问题等方面表现出色,背后是阿里闭源模型。

鲸选AI
算法论文8

颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5

十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数L2 - L3,无L5模型,揭示当前模型不足。

新智元
开源动态8

3B小模型吊打72B巨头!轻量级文档解析OCR,性能超Gemini,高效且精准!

Yuliang - Liu团队GitHub开源轻量级文档解析模型MonkeyOCR,以SRR三元组范式实现高效精准解析,3B参数模型英文文档解析上超Gemini 2.5 Pro和Qwen2.5 - VL - 72B,还介绍了安装部署、适用场景等。

开源星探
开源动态7

24B模型编程超DeepSeek全家桶,32G内存苹果电脑就能跑,专门针对真实GitHub Issue训练

Mistral发布最新开源编程模型Devstral,参数24B,能单卡RTX4090甚至32G内存Mac上运行。它专为编程智能体推出,针对真实GitHub Issue训练,SWE - Bench Verified测试中表现出色,还可与All Hands AI框架配合。

量子位
新闻资讯8

OpenAI重回巅峰:GPT‑5.5全球SOTA,碾压Opus 4.7

OpenAI发布GPT - 5.5,定位为‘为真实工作而生的新一代智能’。它编码、科研、办公等多领域表现出色,能力重心转向‘自主完成任务’,多项评估中成绩优异,还能加速生物医学研究,且Token效率大幅提升。

AIGC开放社区
推荐文章8

突破泛化瓶颈:阿里云智能运维 Agent 评测体系实践

大模型 Agent 智能运维场景落地常遇泛化难题。阿里云李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其提升智能运维 Agent 能力上的成效。

InfoQ
开源动态8

蚂蚁出手VLA,就是开源超越Pi0.5的基座模型

当前具身智能落地面临泛化能力不足的挑战,蚂蚁灵波开源发布的基座模型 LingBot-VLA 带来突破。它基于大量真实世界数据预训练,多项真机任务测试中超越 Pi0.5,且架构、效率等方面有创新。

机器之心