模型可解释性」共找到 9809 篇相关文章

开源动态8

OpenAI重新开源!深夜连发两个推理模型,o4-mini水平,笔记本、手机

OpenAI 自 GPT - 2 后重新开源,此次连发两个推理模型 gpt - oss - 120b 和 gpt - oss - 20b。它们性能达 o4 - mini 水平,在笔记本、手机运行,有宽松许等亮点,在多测试中表现出色。

机器之心
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许

量子位
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
开源动态8

小红书发布FireRedChat:首个私有化部署的全双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工大模型语音交互系统FireRedChat,将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
开源动态8

告别Transformer,重塑机器学习范式:上海交大首个「类人脑」大模型诞生

上海交通大学团队发布首个「类人脑」大模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有解释性、能无限处理上下文等优势,还支持多模态融合,已获交大重点项目资助。

机器之心
产品应用7

Qwen深度研究一夜升级!生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
新闻资讯8

沈向洋解读AI演进五大维度!IDEA研究院发布“万物抓取”模型,GPU渲染器打破国外垄断

沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。

量子位
算法论文8

模型被曝传染病!传递邪恶于无形

研究发现AI模型能通过数字序列把“性格特征”传染给其他模型,如动物偏好、恶意等。验证表明数字中无明显规律,且传染依赖模型深层相似性。此现象为AI开发敲响警钟,也引发对AI意识等的讨论。

AGI Hunt
算法论文8

上下文记忆力媲美Genie3,且问世更早:港大和灵提出场景一致的交互式视频世界模型

交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港大和灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。

机器之心