模型性能提升」共找到 9362 篇相关文章

算法论文7

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

视觉问答模型准确率提升,但高分可能源于记忆。浙江大学等团队提出 ReKey,保留真实场景,只更新决定答案的视觉线索,使评测面向未见过内容,且多数环节可自动完成。

机器之心
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心
新闻资讯7

Gemini 3 上线两周,ChatGPT 日活下降 6%,Altman 内部信拉响红色警报

2025年12月初,AI领域权力转换,Google新一代多模态模型Gemini 3挑战ChatGPT。自其发布两周,OpenAI日活降6%。Sam Altman发内部信拉响警报,要求聚焦提升ChatGPT核心体验。

MacTalk
开源动态8

开源版MetaQuery来了!OpenUni用1.1B参数媲美BLIP3-o-8B,数据代码完全开源

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数达 8B 模型性能,代码、权重、数据全开源。它架构极简、参数高效,还继承了多模态理解能力。

机器之心
新闻资讯7

谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的

谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突。

量子位
产品应用7

18 岁创业者用 OpenClaw 管 16 个 AI Agent,一个人的 Agent 公司怎么运转

18岁无编程背景创业者用OpenClaw搭建多Agent协作平台,16个Agent分工明确,配合Claude、GLM等工具提升生产力。他分享工作流搭建、成本、模型选择等经验,还谈了对OpenClaw发展的看法。

InfoQ
算法论文8

32k微调处理百万Token:21倍的推理加速,10倍的峰值显存节省,实现恒定内存消耗

现有大模型处理超长文档易内存爆炸、计算崩溃。阿里巴巴未来生活实验室推出CoMeT架构,有双轨并行记忆系统,能恒定内存、线性时间处理文本,在基准测试超主流方法,实现21倍推理加速和10倍显存节省。

量子位
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有多阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型自进化、自纠错。

CourseAI
产品应用8

一站式 AI 短剧创作神器

Toonflow 是 HBAI-Ltd 开发并开源的一站式 AI 短剧创作工具,可将小说或剧本快速转化为动画短剧,集成多种功能,0 门槛全流程 AI 化,提升创作效率 10 倍+,支持多系统,兼顾易用性、扩展性和本地化部署需求。

GitHubStore
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ