可解释性研究」共找到 5454 篇相关文章

算法论文8

Evaluation is All You Need:评估设计的微小差异如何扭曲结果

论文以DeepSeek - R1 - Distill系列模型为例,指出大模型评估中看似客观的基准测试结果对评估细节极度敏感,细微评估条件变化会致分数波动大,削弱模型对比信度,呼吁建立新评估标准。

深度学习自然语言处理
新闻资讯7

ChatGPT引爆教育革命,学习效果暴涨86.7%!

新智元报道,Nature子刊元分析汇总51项研究,揭示ChatGPT显著提升中小学生学业表现和高阶思维能力,不限学科和使用方式,还能减轻精神负担,但使用需家长和老师指导。

新智元
产品应用8

Visual Studio 重磅更新!擅长处理复杂任务的 GitHub Copilot “智能体模式”预览版上线

微软 Visual Studio 官方宣布,GitHub Copilot 智能体模式登陆 17.14 预览版。此模式自主处理开发全流程,有确定上下文、建议命令等功能。还引入 MCP 服务器,支持连接外部工具,且更新将更频繁。

AI科技大本营
推荐文章7

2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹

本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。

深度学习自然语言处理
新闻资讯8

12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看

谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,申请体验。

量子位
新闻资讯7

Meta AI大裁员,裁到了田渊栋?

据报道,Meta在人工智能部门裁减约600个职位,波及FAIR等团队。有科学家‘在线求职’,包括FAIR研究科学家总监田渊栋。Meta正将重心转向‘超级智能’,FAIR灵魂人物Lecun辞职威胁或成真。

机器之心
算法论文8

科学家发现大脑中的“旋转风暴”,其结构竟类似Transformer注意力机制

2026年6月18日,叶智文团队关于大脑旋转波的研究成果发表于《科学》。他们借助先进设备发现小鼠脑中旋转波,总结特征、验证其与全脑及行为关联,还指出其类似Transformer注意力机制,未来将继续深入研究

DeepTech深科技
产品应用7

HTML正在成为 AI 办公的新载体?WorkBuddy 升级了一个关键能力

WorkBuddy升级“资料库”功能,普通用户不用写代码,用自然语言就能生成、编辑和发布HTML页面。用户能做书影音地图、播客视化网站等,HTML人机协同编辑,还能实现知识沉淀。

AI科技评论
算法论文8

OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击

OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。

机器之心
开源动态8

开源一个拯救你旅行废片的 Skill

作者因旅行照片不尽人意,开发开源 Skill Yingzao · 营造。它风格多样、能检索文化背景,进行原图对比拼图、多图融合等,适用场景广,还能生成视频,工作方式独特。

歸藏的AI工具箱