低token高压缩」共找到 1724 篇相关文章

开源动态8

国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5

蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。

AIGC开放社区
算法论文8

LLM协作告别文本形式:直接“脑对脑”,Cache-to-Cache实现语义瞬时传输

现有多LLM系统依赖文本通信,效率且易失真。论文提出Cache - to - Cache(C2C)范式,让LLMs通过KV - Cache“脑对脑”交流,实现高效精准语义传输,在多类任务中提升性能与效率。

深度学习自然语言处理
新闻资讯8

Anthropic 发布 AI Agent 上下文工程指南

今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。

AGI Hunt
算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
新闻资讯7

Meta和Scale AI闹翻!砸143亿买的高管跑路,业务也合作不下去

两个多月前,Meta豪掷143亿美元收购Scale AI 49%股份,如今双方在团队融合、业务合作方面产生纠葛。原Scale AI高管离职,Meta研究人员抱怨其数据质量。双方后续发展不尽如人意。

量子位
产品应用7

从需求到研发全自动:如何基于Multi-Agent架构打造AI前端工程师

本文介绍蚂蚁消金前端团队打造的Multi - Agent智能体平台“天工万象”。阐述其技术实践,对比多Agent与统一型Agent、ReAct范式与固定工作流优劣,还介绍专业智能体建设,分享开发中的思考与经验。

阿里云开发者
算法论文8

ICCV 2025 | ECD:高质量合成图表数据集,提升开源MLLM图表理解能力

科研等领域图表是信息核心载体,先进开源MLLMs在高难度图表理解测试准确率。本文提出ECD数据集,规模大、质量高、风格多样,还设计合成流水线与评测基准ECDBench,为开源MLLM提供支持。

机器之心
开源动态8

突发!字节开源 36B 模型Seed-OSS

字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。

AGI Hunt
产品应用7

根治『降智』反骨仔,ChatGPT-5几条实用窍门

ChatGPT-5发布后口碑崩溃,“降智”行为不断,如发布会图表错误、算术题答错、智商测试得分。不过作者找到增智方法,像修改提示词、让其建立行动规划等,还介绍恢复旧模型及OpenAI后续计划。

鲸选AI
新闻资讯7

千亿市值巨头,超百亿押注算力产业链

东山精密在今年6月收购光模块企业索尔思光电后股价暴涨、市值破千亿,近日又宣布子公司投资不超10亿美元建高端PCB项目。两项投资额超百亿,但索尔思光电有研发迟缓、毛利率等问题,东山精密高端PCB技术也不足。

芯师爷