性能测试」共找到 3325 篇相关文章

产品应用8

Agnes:不做通用型智能体丨对话全民AI应用平台Agnes AI

量子位智库对话Agnes AI创始人Bruce Yang,探讨多智能体在AI产品的应用。Agnes AI以Multi Agent架构为核心,上线四月日活破20万。其介绍了核心功能、单多智能体差异、评估维度等,还谈及目标人群、市场规模等内容。

量子位
算法论文8

用「传心术」替代「对话」,清华大学联合无问芯穹、港中文等机构提出Cache-to-Cache模型通信新范式

随着大语言模型发展,多智能体系统中现有T2T交流方式有信息丢失、语义模糊、延迟大问题。清华等团队提出C2C信息传递方式,以KV - Cache为媒介,提升了正确率和速度,还介绍了实现路径、优势及应用前景。

机器之心
新闻资讯7

AI算力饥渴和高能耗困局谁来解?两位95后创始人用相变材料光计算构建新范式

AI算力供需失衡致数据中心能耗激增,传统电芯片性能提升放缓。光本位科技由两位95后创立,2024年6月流片全球首颗128×128矩阵规模光计算芯片,推动光计算商业化,正布局产品商用。

机器之心
产品应用8

LLM 技术在有道词典笔上的应用实践

本文围绕LLM技术在有道词典笔的应用展开。先分析端侧大模型落地挑战,如算力、功耗等。介绍有道词典笔等硬件及应用,对比端侧与云侧AI优劣。还阐述模型落地模式、算法优化及“子曰3数学模型”开源情况。

InfoQ
开源动态8

重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个

DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还能处理多类图像与近100种语言。

新智元
开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
算法论文8

Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了

Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。

量子位
产品应用8

AI 原生设备爆发,操作系统迎来更智慧、更流畅、更安全的范式革命

AI原生设备爆发,传统操作系统面临挑战,将迎来范式革命。vivo蓝河操作系统3(BlueOS 3)全栈自研,具备“天生更智慧、更流畅、更安全”特质,本文以此为例解读操作系统架构重塑。

InfoQ
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理
推荐文章8

SGLang 确定性推理实现技术细节笔记

文章围绕SGLang确定性推理展开,介绍其启用方式,详述批次不变性原理与Batch Invariant Ops实现,如Matmul Persistent Kernel设计;还阐述确定性采样、Attention Backend配置、AllReduce改动等,给出环境变量及测试脚本,有完整解决方案。

GiantPandaLLM