预训练数据精炼」共找到 3943 篇相关文章

产品应用7

阿里云 Tablestore 基于 Mem0 为 OpenClaw 构建记忆系统最佳实践

文章指出 OpenClaw 原生记忆有失忆、多 Agent 记忆不通等问题,介绍阿里云 Tablestore 基于 Mem0 为其构建记忆系统的实践,包括优势、安装步骤,实测记忆持久生效,还提及后续实践值得期待。

阿里云开发者
算法论文8

让大模型基于「图像事实」说话:用事实文本+自适应编辑,让语言偏见无处遁形丨ICLR'26

多模态大模型看图常“脑补”,存在对象幻觉问题。北航团队提出AFTER框架,含FAS和QAO模块,能在主流LVLM和基准上显著降低幻觉,且推理开销低,为多模态助手落地提供实用路径。

量子位
新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。

AGI Hunt
算法论文8

CVPR 2026|清华联合美团推出3DThinker,首个用3D意象思考的工作

当前多模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合美团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在多基准上提升效果,且具备一定可解释性。

机器之心
产品应用8

科学家的超级合伙人来也!星河启智「大圣」让高能动性AI「入局」真实科研

星河启智平台推出超级科研合伙人「大圣」,它构建了多模态科学基础模型等智能体协作研发能力,具备认知、行动、记忆、验证四大能力,且引入可信安全机制,推动科研生产关系重排。

机器之心
开源动态8

Context Mode:为你的AI开发工具节省98%的上下文token

开发者分享开源项目Context Mode,它在Claude Code和工具输出间加中间层,采用沙箱隔离和精准检索策略,能节省98%上下文空间,与Cloudflare Code Mode互补,可提升AI从业者工作效率。

AI工程化
开源动态8

智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析

智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。

AIGC开放社区
新闻资讯7

传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%

小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。

AI寒武纪
推荐文章7

“Skill 不就是长一点的提示词吗?”

文章回应了对'skill是长提示词'的质疑,指出差异在于提示词配套的是ChatBot还是Agent。ChatBot只能对话,Agent能调用工具干活。Skill可渐进加载,具可复用、组合、迭代等优势,是提示词工程化封装。

宝玉AI
开源动态8

2026开年王炸模型MiroThinker 1.5实测:Google和GPT没做到的事,被它做到了

自媒体从业者实测开源模型MiroThinker 1.5,它不拼参数规模,注重去伪存真。在多场景测试中表现出色,如投资决策、内容查证等。其技术揭示大模型未来或在于外部交互,而非参数膨胀。

AI寒武纪