128K上下文」共找到 1236 篇相关文章

推荐文章8

多尺度特征融合:原理、结构与实用算法案例

文章介绍多尺度特征融合技术,它结合网络不同层次特征以捕获丰富上下文信息,在目标检测等任务广泛应用。阐述原理、常用方法,介绍FPN、U - Net等结构,并给出基于这些结构的实用算法案例与Python代码。

机器学习AI算法工程
算法论文8

句子级溯源+生成式归因,C²-Cite重塑大模型可信度

在人工智能发展背景下,大模型内容可信度成焦点。北邮百家AI与小米团队提出溯源大模型C² - Cite,首创上下文感知归因生成技术,解决现有归因模型缺陷,已被WSDM 2026收录。

机器之心
开源动态7

DeepSeek终于丢了开源第一王座,但继任者依然来自中国

几千人盲投中,Kimi K2超越DeepSeek成全球开源第一,总榜第五紧追顶尖闭源模型。虽有人质疑其采用DeepSeek V3架构,但团队称有参数调整。当下开源模型崛起,正打破性能弱的刻板印象。

量子位
开源动态7

18岁华人开源成果,火爆具身智能赛道

18岁华人小哥Eddy Xu的初创公司Build AI开源了有史以来最大的人类为中心数据集Egocentric - 10K,含10亿帧画面,规模是同类的100倍,场景扩展至工厂。不过其缺乏多模态信息,且human - centric路线也有局限。

量子位
开源动态8

Code Arena全球可用模型第一!智谱GLM-5.2上线并开源

智谱上线并开源GLM-5.2,在Code Arena等平台表现优异,长任务跑分出色,架构有突破,支持100万token上下文,还引入控制功能。模型在常用编程智能体可用,适配国产算力平台,以MIT协议开源。

AIGC开放社区
开源动态8

在AK大神爆火的任务里,摸清国产AI真实水平

4月20日深夜Kimi K2.6发布并开源,作者借Andrej Karpathy的AI Wiki思路设计高承压任务,测试其Agent底层能力,考察它在单Agent、Agent网站和Agent Swarm三种模式下表现,探究国产AI真实水平。

InfoQ
开源动态8

看遍奥斯卡后,VLM达到电影摄影理解新SOTA|上海AI Lab开源

上海人工智能实验室等推出ShotBench、ShotVL及ShotQA,ShotBench含超3.5k问答对,ShotQA约7万个问答对。ShotVL在ShotBench评测中表现出色,3B参数的ShotVL-3B增益达19.0%,超越GPT - 4o等。

量子位
开源动态8

全球首个!10万小时人类数据全开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
开源动态7

实测最新开源的DeepSeek-OCR后,我有些不一样的看法,有些话可能只有我敢说

实测最新开源的DeepSeek - OCR,它并非传统OCR,不适用于传统场景。其最大意义是解决大模型上下文长度问题,通过文字图片压缩解压提高处理速度。模型功能多样,是让AI看图思考的新思路。

开源AI项目落地
开源动态8

AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源

超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。

InfoQ