推理缓存优化」共找到 3061 篇相关文章

产品应用8

快手发布Keye-VL-1.5,同量级SoTA,让模型真正看懂视频!

近年来,多模态大语言模型兴起,但视频理解仍是难题。快手Keye团队推出Keye-VL-1.5,通过Slow-Fast编码策略、渐进式四阶段预训练和全面后训练流程等创新,实现视频理解突破,综合性能领先。

深度学习自然语言处理
开源动态8

斩获5.5K star!!AI 加持到位,安全感拉满,这个升级版开源知识库神器太顶了!

两个月前分享的开源AI知识库项目PandaWiki,迭代速度惊人。此次更新多个大版本,编辑器体验提升,AI成智能客服,支持20+家模型供应商,还优化团队协作功能和诸多细节,更成熟实用。

开源先锋
产品应用7

阿里老兵造出会说话的迪迦!AI玩具单品20万销量,红杉等2亿A轮抢投

跃然创新推出全球首款迪迦奥特曼AI玩具,完成2亿A轮融资。其首代产品BubblePal销量达20多万台。新品改进诸多不足,优化体验,强调安全。公司瞄准AI Friend,未来产品分儿童和成年线。

量子位
新闻资讯8

第一名方案公开,代码智能体安全竞赛,普渡大学拿下90%攻击成功率

亚马逊举办代码智能体安全比赛,普渡大学团队 PurCL 作红队以超 90% 攻击成功率夺冠。他们耗时八月、花百万美元开发全过程红队系统并开源,还发现当前 AI 安全研究在复杂领域对齐有挑战。

机器之心
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
新闻资讯7

逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……

Cornell大学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用大量版权材料问题,此成果引发社区激烈讨论。

AGI Hunt
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区
新闻资讯8

微软发布5大AI Agent模式:一键解锁AI员工,打造智能体工厂

今天凌晨微软官网发布5种常用Agent模式助用户开发自动化AI员工。智能体比传统自动化工具更具优势,能推理协作等。各模式都有应用案例,且Azure AI Foundry支持多Agent模式开发。

AIGC开放社区
算法论文8

联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像

图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。

机器之心
算法论文7

阿里、南开大学发布免训练,视频大模型创新压缩方法

视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。

AIGC开放社区