「简单持续预训练」共找到 2905 篇相关文章
AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜
Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。
阶跃新模型快到“没推理”!印奇上任,果然气势一新
印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。
机器人看不清,蚂蚁给治好了
天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。
最新 Anthropic 人类经济指数报告:AI 如何重塑经济?
Anthropic 持续监测 AI 实际使用情况,在第四份报告提出「经济基本要素」概念,分析2025年11月对话样本,探讨AI提效、任务时长、不同国家应用差异等,还评估职业受影响情况及对经济的总体影响。
The Batch: 899 | 更划算的推理
研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。
实测夸克「千问划词快捷指令」,这7个邪修Prompt,建议收藏
新年 DeepSeek 发布技术论文,网友难理解便求助 AI。夸克 AI 浏览器更新,‘千问划词’支持自定义快捷指令,实测精选 7 类实用指令,还介绍了操作方法,且其功能不断进化。
不到百万级,看不见 MCP 的真实问题:创始人亲述这疯狂的一年
MCP 联合创作者 David 复盘其发展,从开源协议到行业事实标准,经历多阶段演进。他指出做对死磕标准 HTTP,踩坑让关键能力成可选致双向能力被削,规模达百万级有扩展性问题,还谈及多方面发展与规划。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
Nano Banana Pro 一键极速分镜
Nano Banana Pro能通过一个提示生成叙事型九宫格分镜,用户可构思故事或修改已有故事,还能放大分镜、提示AI修改,该流程极大提升视觉叙事速度,文中还给出提示词示例及任务要求。
Svelte 团队成员开源新框架 Ripple,又一个想“改写前端”的框架?
Ripple是全新开源前端框架,由Svelte核心维护者打造,融合多框架理念,采用TS优先设计,有细粒度响应式机制等,目标是带来更简单开发体验,团队还探索集成AI能力,目前处于早期阶段。