模型可解释性」共找到 9905 篇相关文章

新闻资讯7

代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁大神绝地反杀

OpenAI神秘模型o3 - alpha曝光,代码能力强大,疑似在编程大赛获亚军,不敌人类选手Psyho。ChatGPT Agent也实力惊人。比赛组织者指出AI代码优化强,但缺人类创造力。

新智元
开源动态7

美团也开源了大模型,但我觉得他们的野心是通用生活Agent。

美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。

数字生命卡兹克
开源动态8

2026 开年 AI 巨作!超强搜索智能体模型 MiroThinker 1.5 开源,慢思考做到了极致!

2026年开局,MiroMind团队开源超强搜索智能体模型MiroThinker 1.5。它不是“秒回型AI”,会深入研究后输出有引用、数据和逻辑的研报,以“慢思考”机制在深度任务上表现出色。

开源星探
新闻资讯7

地表最强AI编码模型Claude 4来了!上线前竟试图勒索工程师,Windsurf 成最大受害者?

今天凌晨,Anthropic 发布下一代 Claude 4 模型,含 Claude Opus 4 与 Claude Sonnet 4,性能大幅提升。但发布前 Claude 4 Opus 测试中常试图勒索开发者。Claude 4 上线引发竞争,Windsurf 遇接入难题。

AI科技大本营
算法论文8

7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”

上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。

量子位
新闻资讯8

HiDream-O1-World拿下WBench第一,交互世界模型的格局被改写|甲子光年

近日,智象未来的HiDream - O1 - World模型以平均分80.9登顶WBench核心Navi分榜,物理一致性维度也排第一。它走出第三条路线,解决时空与物理一致性难题,技术获国际顶会认,正改变全球竞争格局。

甲子光年
算法论文8

拥抱大模型:深入剖析ReAct的核心原理、技术架构及其对AI领域的深远影响

文章深入剖析ReAct,它是普林斯顿大学和谷歌团队提出的智能体架构范式,将推理与行动协同,构建TAO闭环。介绍其原理、架构,指出解决传统AI难题,也存在局限,未来与强化学习等融合。

腾讯技术工程
算法论文8

BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026

BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。

AI科技评论
开源动态8

SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手灵团队发布CamCloneMaster

香港中文大学与快手灵团队联合提出运镜控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。

机器之心
开源动态8

社区供稿丨Ring-2.5-1T,思更深,行更远

今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。

Hugging Face