1M上下文」共找到 2403 篇相关文章

算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
产品应用8

AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队

Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。

AI前线
新闻资讯7

GPT-5.2发布,真正的牛马打工人专属AI来了。

OpenAI十周年凌晨2点发布GPT - 5.2。它在部分跑分上提升不大,但在ARC - AGI - 2和GDPval评测集表现亮眼,上下文处理能力也大幅加强。将开放给会员使用,价格比5.1贵。

数字生命卡兹克
新闻资讯7

靠AI破解癌症,初创公司融下3000万刀!新目标:建10亿单细胞数据集

福布斯介绍,初创公司Tahoe Therapeutics融资3000万美元构建活细胞AI模型,估值达1.2亿美元。该公司已研发出针对一种主要癌症亚型的候选药物,还开源数据集,与其他公司合作开发AI agent。

量子位
新闻资讯8

中国第一,直逼OpenAI!神秘「扫地僧」冲到全球前七

神秘中国AI「扫地僧」MopMonk以73.1%胜率杀入CyberGym全球前七,紧咬OpenAI。它用MiniMax M3为基座,靠结构化记忆、多Agent并行等策略提升漏洞挖掘执行力,示范开源基座极致利用之路。

新智元
开源动态7

实测Perplexity Pro平替模型,免费开源仅4B

一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。

量子位
推荐文章7

Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)

文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。

AINLPer
产品应用7

用最简单的大模型技术打造一个迁云专家有多难?

文章探讨在云迁移领域用大模型技术“复制”专家80%核心能力。分析标准化方案不足及简单RAG局限,介绍“LX0.1”AI专家助手构建,还提及分层评测、人机协同等优化,最后展望AI在云迁移的未来方向。

阿里云开发者
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元