省Token」共找到 715 篇相关文章

算法论文8

真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文

MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。

量子位
新闻资讯7

499上门装龙虾的人,开始赚299卸载龙虾的钱了

OpenClaw(龙虾)付费部署火爆后,卸载业务也成大型产业链,遍布多平台。因安全隐患多、烧Token等问题,不少人选择卸载。商家服务分层、价格灵活,甚至还有人盯上教小朋友学龙虾的生意。

量子位
开源动态8

Emu3.5:能够原生预测下一状态的多模态世界模型,媲美Nano Banana

北京智源研究院推出多模态世界模型Emu3.5,能原生预测视觉和语言下一状态。用超10万亿token数据预训练,后经强化学习训练。团队提出DiDA提升推理效率,其性能媲美Nano Banana,项目已开源。

AI工程化
产品应用7

GPT-6最大的升级,是每天送你一张免费重置卡。

GPT - 6刷屏,虽不能马上给用户用,但跑分碾压,似被fable5.1逼出。重置义父想出每天送一张重置卡的补偿办法,口碑反转。OpenAI还更新订阅额度限制,token变贵,很多公司开始适应峰谷定价。

探索AGI
产品应用8

这个Coding Agent框架要火!Cursor、Claud太慢了

AI Agent赛道爆发,开发编码代理效率低。新出的jcode框架将Coding Agent功能整合,解决痛点,内存效率高、启动快、资源占用少,还能为开发者80%底层开发时间。这是赛道成熟信号。

CourseAI
开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
开源动态8

长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”

北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。

AIGC开放社区
产品应用8

我用一张照片,生成了一个能走进去的世界

斯坦福李飞飞创办的World Labs发布新产品Marble,用一句话或一张照片就能生成3D游戏世界,用户可自由探索。它能降低3D建模门槛,提高影视游戏行业工作效率,潜力大但前景或取决于Token成本。

新智元
算法论文7

阿里、南开大学发布免训练,视频大模型创新压缩方法

视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。

AIGC开放社区
算法论文8

北大-灵初重磅发布具身VLA全面综述!一文看清VLA技术路线与未来趋势

GPT-4o等多模态基础模型发展,让研究者探索将智能延伸到物理空间,VLA模型受关注。北大 - 灵初联合实验室从动作词元化视角提出新框架,分析主流action token,还介绍了VLA发展趋势及面临挑战。

机器之心