参数压缩 - 覆盖假说」共找到 1216 篇相关文章

新闻资讯7

Mistral 为 Le Chat 新增远程智能体与 Work 模式

Mistral发布1280亿参数的Mistral Medium 3.5模型,在Vibe和Le Chat引入云端智能体能力,还在Le Chat新增Work模式。新模型可自托管,支持长上下文窗口。社区反馈积极,开发者认可,也有人嫌定价贵。

InfoQ
产品应用7

华创七星微:为直流供电系统筑起一道防火墙

随着AI等领域设备迭代,电源保护重要性凸显。华创七星微依托六类量产芯片和将问世的集成模块,为直流供电系统提供防护,其产品覆盖供电链路关键节点,有完整解决方案,还具备多种能力优势。

芯师爷
开源动态8

SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」

腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。

量子位
产品应用7

Claude Code 推出 Monitor 功能,帮你随时盯梢

Claude Code 在 v2.1.98 版本推出 Monitor 功能,可让 Agent 后台挂监控脚本,解决轮询痛点。它能覆盖日志监控等多场景,与 /loop、/schedule 功能有别,使用有注意事项,反映 Anthropic 让其成工程系统的方向。

AGI Hunt
产品应用8

给 OpenClaw 再加一道安全护栏

为保障智能体安全,开发了SKILL,覆盖安装前到运行中的全生命周期。安装前进行九类风险检查,运行时有guard机制,从六个方面看风险,设四层风险分级和输入信任等级,目标是让智能体更可控。

深度学习自然语言处理
产品应用8

Tair 短期记忆架构实践:淘宝闪购 AI Agent 的秒级响应记忆系统

本文从淘宝闪购与千问合作的‘一句话点外卖’项目出发,介绍 Tair 在 AI Agent 记忆管理中的数据模型设计、压缩策略与并发控制等关键实践,展示其在低延迟、数据建模、并发安全和弹性抗压等方面的能力。

阿里云开发者
开源动态8

小米的首代机器人VLA大模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源

具身机器人成科技新热点,大家期待其释放生产力。小米首代具身VLA大模型Xiaomi - Robotics - 0抓间歇停顿问题,4.7B参数规模下推理延迟仅80ms,还做三项技术创新,且全面开源。

量子位
算法论文8

腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式

过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。

AI科技评论
算法论文8

56倍加速生成式策略:西交大提出EfficientFlow,迈向高效具身智能

生成式模型在机器人和具身智能领域面临训练依赖大量数据、推理慢的问题。西安交通大学团队提出EfficientFlow,融合等变建模与高效流匹配,提升数据效率,压缩推理迭代步数,在多基准实现SOTA,推理提效显著。

机器之心
新闻资讯7

顶尖技术+标准产品+创新模式+可靠服务,打造大模型商业落地中国范式 | 卓世科技@MEET2026

在大模型参数竞赛白热化的当下,焦点转向模型如何在行业存活、产生价值。卓世科技合伙人赵策在MEET2026大会提出,大模型下一场竞争在模型、终端、数据与业务流闭环,该司据此在多领域落地应用。

量子位