1M上下文」共找到 2419 篇相关文章

算法论文8

清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍

清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。

量子位
新闻资讯7

Synk收购Invariantlabs-AI安全技术的强强联手

2025年6月24日,安全AI软件开发领导者Snyk宣布收购AI安全研究公司Invariant Labs。Snyk CEO称收购增强了抵御新兴威胁能力。Invariant Labs在MCP领域领先,成果丰富,Snyk也有多样产品,合并有望带来1+1>2效果。

AI与安全
产品应用7

Apple 终于承认了:Mac mini 正在变成一台 Agent 服务器

苹果偷摸发布新 Mac mini,处理器升级到 M6 和 M5 Pro,官方将其置于 Agent 常驻使用场景,产品边界向 Agent 服务器延展。新款性能提升显著,Mac Studio 也有强大配置,Apple 产品线朝本地 AI 计算基础设施转变。

MacTalk
7

PyPI遭投毒!LiteLLM用户Python启动就中招,个人凭证秒泄露

PyPI被投毒,LiteLLM1.82.7和1.82.8版本被植入信息窃取程序,安装后SSH密钥等数据会泄漏。该漏洞源于Trivy被篡改,攻击者借此发布恶意版本。已给出自检流程,供应链攻击或常态化。

量子位
推荐文章8

MCP 和 Skills 到底什么区别?一篇文章说清楚

文章解释了 MCP 和 Skills 的区别。MCP 是 AI 世界的 USB 协议,可降低开发成本,但会吃掉上下文窗口;Skills 采用渐进式披露设计,自带脚本,能减少上下文消耗。未来 Skills 或承担多数工作,MCP 用于远程连接。

宝玉AI
算法论文8

SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能

在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。

AI科技评论
开源动态8

代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放

检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。

机器之心
新闻资讯7

马斯克暴走官宣:Grok 5就是AGI!五月连轰两代万亿怪兽,OpenAI慌了

马斯克宣称Grok 5就是AGI,5月将连发1T和1.5T两代万亿参数模型。Grok 4.3已上线,4.4、4.5将相继推出,Grok 5正以6万亿参数规模训练。不过,参数能否堆出AGI存争议。

新智元
新闻资讯8

00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代

00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。

新智元
新闻资讯7

Reddit 上爆出大猛料,Claude 为何封号中国用户又快又准?

Reddit大佬逆向Claude Code 2.1.196版本,发现Anthropic为防中国用户,早在2.1.91版本就装监控程序。它用隐写手段标记并回传用户信息,代码也经加密混淆。Claude Code负责人称是防滥用实验,将回滚检测逻辑。

AI科技评论