「低熵世界」共找到 1926 篇相关文章
ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御
合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。
72天,从0到千万小时产能,这个具身「新锐派」凭什么接管数据赛道?
觅蜂科技成立72天亮出破局方案,推出MEgo系列无本体数据采集硬件,同步发布数据服务平台、治理引擎,启动蜂巢数据共创行动,与多家头部企业合作,欲解决具身智能数据难题。
不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?
Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。
最强大脑组合!全球SOTA的逻辑和记忆CodeBrain-1&MemBrain1.5同时开源
世界模型初创公司Feeling AI正式发布并开源MemBrain1.5和CodeBrain-1,终结AI“无状态”工具时代。CodeBrain提升模型操作成功率、降低成本,MemBrain重构记忆系统,二者助力Agent能力升级。
The Batch: 907 | 小而高效模型的“制作”方法
Mistral AI发布Ministral 3系列模型权重,结合剪枝与蒸馏技术,用级联蒸馏法构建。该系列参数规模有140亿、80亿和30亿,在部分测试中表现佳,训练成本低于传统方式。
杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源
杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。
OpenAI CFO 摊牌:算力即营收,而 90% 的企业正被卷死在“能力鸿沟”里
本期 OpenAI 播客嘉宾,CFO Sarah Friar 和投资人 Vinod Khosla 探讨 AI 应用。指出多数人使用 AI 能力有限,2026 年是弥合“能力鸿沟”开端。还提及算力与营收相关,OpenAI 在企业端已领先,创业公司也有机会。
“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约
当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。
空间智能终极挑战MMSI-Video-Bench来了,顶级大模型全军覆没
上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流多模态大模型进行评测。该基准题型全面、问题具挑战性,视频数据多样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。
自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。