「迭代迁移」共找到 810 篇相关文章
Databricks开源限流方案,抛弃redis,性能提升10倍
Databricks 开源高性能限流系统设计,抛弃 Redis,通过内存分片和批量上报机制,实现 10 倍性能提升。还将限流算法改为令牌桶,解决了精度控制、在线迁移等问题,权衡了分布式一致性。
追平GPT-4o,数学基测96.3%高分,Hermes4 来了
Nous Research推出新一代大模型Hermes 4系列,其有混合推理和长度控制机制,还能用DataForge“造”数据,经Atropos质检。它在数学等领域表现佳,追平GPT - 4o,是开源AI对巨头的挑战。
Oxlint 1.0 稳定版发布:基于 Rust 的 JavaScript 静态检查器
Oxlint是基于Rust的JavaScript和TypeScript静态检查器,其1.0稳定版发布。它有快速检测、规则覆盖广等特点,性能比ESLint高50 - 100倍,能处理多文件规则,开发者反馈积极。
强化学习也能预训练?效果可提升20倍,华人新作引爆RL新范式!
伯克利团队提出新方法InFOM,不依赖奖励信号,能在多任务中超强迁移与推理。在36个基于状态和4个基于图像的任务测试中,InFOM表现出色,在jaco任务上改进达20倍。
一文读懂深度表格数据表示学习 | 南京大学
南京大学团队系统介绍表格表示学习领域,将现有方法按泛化能力分三类,比较DNN与树模型优劣,剖析核心挑战,探讨扩展方向及数据集评估策略,旨在建跨数据集稳健评估体系。
o3-pro通关“推箱子”,人类怀旧小游戏成了大模型新Benchmark
推箱子、俄罗斯方块等经典小游戏成大模型benchmark,o3 - pro挑战这两款游戏表现出色,突破benchmark上限,成绩远超o3。Lmgame含多款游戏,有不同评价方式,且开源可用于模型测试。
Anthropic CEO :AI 或致千万白领失业,呼吁对AI公司征税
Anthropic的CEO达里奥·阿莫代称AI发展或致严重就业危机,未来1 - 5年冲击就业市场,金融等行业入门级白领工作首当其冲。他认为无法暂停AI研发,呼吁思考应对之策,还建议对AI公司征税。
突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
Claude Code与Codex六大组件拆解
文章指出如今如GPT - 5.6等模型的裸能力相近,但装进Claude Code 或 Codex CLI 后表现差距大,原因在于Agent Harness。它将编码智能体拆解为六个核心组件,详细阐述各组件作用与意义。
多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26
多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。