「可观测性数据」共找到 5972 篇相关文章
GLM-5正式发布,744B参数,对标Claude
GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。
One RL to See Them All?一个强化学习统一视觉-语言任务!
国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。
字节推出X-Streamer,实时口型同步与长程记忆数字人框架
字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。
RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘
近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。
ICLR 2026 Oral|多模态知识图谱对齐难:破解噪声关联至为关键
在数据多元化时代,多模态知识图谱能为下游应用提供数据支撑,实体对齐是构建知识图谱的核心技术。但大规模知识图谱关联与融合面临噪声和潜隐关联挑战。四川大学团队提出 RULE 方法,缓解了这些影响,论文被 ICLR 2026 接收为 Oral。
LeCun在Meta的最后一篇论文
LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。
后AlphaFold时代的冷思考,AI制药的破与立 | GAIR live 028
雷峰网等组织“后AlphaFold时代AI制药的破与立”线上圆桌,三位学者探讨AI制药问题。指出算力难颠覆生命法则,数据有缺陷,还给出赛道选择建议,提及AI Agent重塑科研关系及中国AI制药优势与挑战。
初识App Store和苹果审核【第一期】深度解析
App Store的审核流程和苹果惩罚机制究竟是怎样的?文章详细解析了App Store的变迁、分发模式、开发者账号区别、上架流程、审核流程和依据,以及惩罚机制和应对方式。
狂揽 18.9K star!这款开源、免费、功能超强的物联网 IoT 平台项目,太6了!
物联网技术成行业发展关键,但构建系统挑战大。开源项目ThingsBoard应运而生,提供一站式解决方案,功能强大,如规则引擎、告警管理等,安装部署简单,值得开发者尝试。
吴恩达来信:利用编程智能体实现更高效开发
吴恩达认为编程智能体正加速各类软件工作,按加速程度排序为前端开发、后端开发、基础设施、研究。前端开发加速明显,后端开发有提升但幅度小,基础设施和研究方面加速有限。