超长上下文处理」共找到 1561 篇相关文章

新闻资讯8

DeepMind 再放大招,AlphaGenome 能一次性处理百万碱基对,基因组里的“垃圾代码”这下藏不住了

Google DeepMind发布AI模型AlphaGenome,可预测遗传变异对基因调控的影响。它能处理百万碱基对,结合关键技术,性能顶尖,还能直接建模RNA剪接点,已面向非商业研究开放,引发医疗AI应用讨论。

InfoQ
开源动态8

视频理解新标杆,快手多模态推理模型开源:128k上下文+0.1秒级视频定位+跨模态推理

快手开源能看懂视频并跨模态推理的大模型Keye-VL 1.5,其有时序定位、描述和推理能力,跑分领先。采用三段式架构和Slow-Fast编码策略,经四阶段预训练和多阶段后处理,团队成果多,推动多模态技术落地。

量子位
产品应用7

我用 GLM-5.2 读 148 万字资料:一天读懂一个知识

作者用 GLM-5.2 处理 148 万字 Transformer 资料,它生成可打开的 HTML 阅读页,将内容排成理解路线。GLM-5.2 在评测榜单中进入第一梯队,主打 1M 上下文,还分享了使用该模型处理资料的具体做法。

AI产品自由
推荐文章8

辛顿、杨立昆等 AI 先驱都源自信号处理——对话 IEEE 首位华人主席、美国双院院士刘国瑞 | 万有引力

本文是对IEEE首位华人主席刘国瑞的访谈。他分享了科研、创业经历,谈到AI先驱多源自信号处理,鼓励年轻人追梦,还探讨了科研模式、合成数据、AI应用及未来生活图景等话题。

AI科技大本营
开源动态7

4.5k星星爆火!用图片压缩Fable 5上下文,成本大幅降低,终于用得起这个模型了

Fable 5在AI圈爆火,但使用成本比其他型号贵至少5倍。pxpipe项目把适合压缩的大段文本渲染成PNG图片,交给多模态模型读取,能大幅降低成本,还能增加上下文长度。

开源AI项目落地
算法论文8

能效翻5倍!他们复刻人脑双记忆通路,造出能长效记住上下文的类脑AI芯片

帝国理工学院博士后孙鹏飞和苏黎世联邦理工博士后苏哲及合作者,受大脑皮层机制启发,打造“双重记忆路径”类脑网络及配套芯片,处理语音识别任务时能效比此前优方案高5倍。相关论文发表在《自然·机器智能》且代码、设计全开源。

DeepTech深科技
产品应用7

比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!

字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,可实现从想法到应用的一站式交付。上下文工程领域热度攀升,该概念因Andrej Karpathy推动而爆火,Trae迭代快,已建立完整能力体系。

InfoQ
算法论文8

Shopee OnePiece:业内首个融合上下文工程、隐式推理和多目标训练策略的生成式搜推建模框架

2025年生成式推荐发展火热,但工业界落地多在序列化建模,替换传统范式遇阻。Shopee傅聪团队联合人大高瓴学院提出OnePiece范式,是业内首个融合多策略的生成式搜推建模框架,含上下文工程、隐式推理和多目标训练策略。

InfoQ
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型!

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
新闻资讯7

AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效率,Token成本失控后上下文工程成胜负手

本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。

InfoQ