上下文图」共找到 913 篇相关文章

开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
算法论文8

英伟达港大联手革新视觉注意力机制!GSPN高分辨率生成加速超84倍

香港大学与英伟达联合推出广义空间传播网络(GSPN)。它采用二维线性传播与“稳定性 - 上下文条件”,将计算量降低,保留像空间连贯性。在多视觉任务刷新性能纪录,如高分辨率生成加速超84倍。

量子位
产品应用7

高考第一天,用豆包修3.0花式「整活」送祝福,已原地笑翻!

豆包的一句话P功能进化,其像编辑模型SeedEdit 3.0全量上线,AI修进入3.0时代。用自然语言就能精准编辑片,在文字编辑、局部修改等方面表现出色,还突破以往模型瓶颈,成设计师利器。

新智元
新闻资讯8

奥特曼震撼预言:6个月后,ChatGPT将彻底接管你的人生

OpenAI首席执行官奥特曼预言,未来6个月,下一代AI将彻底看懂用户,实现人机共生。当前OpenAI的Chronicle和Dreaming V3分别在屏幕上下文与对话合成方面有进展,且几乎整个AI行业都在押注记忆方向。

新智元
新闻资讯8

ChatGPT语音杀入桌面!你负责动嘴,一群AI负责干活

近日OpenAI将ChatGPT语音功能正式引入桌面版,其底层是新一代语音模型GPT - Live。大佬们看好语音输入,因其能高带宽传递上下文。该功能不仅能闲聊,还可调度智能体,OpenAI想让ChatGPT成AI工作操作系统。

新智元
产品应用7

姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人

腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。

量子位
新闻资讯7

DeepSeek不惜代价保住它!V4关键特性被挖出来了

DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。

量子位
推荐文章7

一种可以减少 CI 回归测试套件规模的更佳方案

作者作为测试架构师,认为减少CI回归测试套件规模理论诱人但实践常失望。介绍有效处理大型测试套件的方案,如随机趋势分析、多上下文模式匹配等,还谈及无门控测试等优势,能助力管理测试集。

InfoQ
开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。

阿里云开发者
产品应用8

可灵 2.1 首尾帧藏师傅外挂教程:两张→大片,附万能提示词

作者分享可灵 2.1 首尾帧模型测试与使用教程,解决片和提示词生成难题。介绍三种拿法,给出 AI 生成提示词方法及原则,还指出可将流程固化、特效升维,提升视频创作效率与价值。

歸藏的AI工具箱