可解释性综述」共找到 4146 篇相关文章

新闻资讯7

Claude 4 要来了!

AI专家在Anthropic前端配置发现Claude 4痕迹,其或有查看AI思考过程功能。当下OpenAI、Google、xAI等对手来势汹汹,Claude 4压力大,但解释性等方面破局,预计5月22日公布。

AGI Hunt
开源动态8

Qwen-Scope:看穿大模型的“小心思”

Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的解释性模块,通过在隐藏层插入SAE提取解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,前往Huggingface或魔搭体验。

千问大模型
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
开源动态8

多模态Deep Research,终于有了「核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
新闻资讯7

大模型终于通关《宝梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝梦对大模型的挑战,谷歌将继续探索,网友提议用通关宝梦测试大模型 。

量子位
产品应用8

实测灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测灵2.5新视频模型,它已灰度内测并登上釜山电影节。与灵2.1对比,灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过学习参数融合,提出学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或降低大规模计算成本。

力学与人工智能
产品应用7

Agentic 应用时代,Dify 全链路观测最佳实践

文章讲述 Dify 平台在 Agentic 应用开发的观测性挑战,从开发者与运维方视角分析现状、局限与改进方向。云监控推出全景观测方案,还介绍各组件监控接入步骤及实践指南,最后提及 Qwen - Image 生图优势。

阿里云开发者
产品应用7

本地运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore
产品应用7

魔笔 AI Chat Builder:让 AI 对话秒变交互界面

文章介绍阿里云魔笔AI Chat Builder,它能将AI对话变交互界面。对比现有AI应用开发方式,阐述其综合优势,还介绍核心能力、搭建方法、多端发布等,未来将打磨能力并推新功能。

阿里云开发者