「可解释性研究」共找到 5582 篇相关文章

推荐文章9

模型一模一样,Token 却相差 70 倍?三项实测揭开 AI 编程工具的成本黑洞

本文通过三项独立基准测试,证实相同AI模型下,不同AI编程智能体框架的Token消耗最高相差70倍,分析了成本差异的核心原因,为企业AI成本控制提供可落地的衡量标准。

AI前线
算法论文8

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软和 UIUC 合作研究 StudentSim,基于真实学生数据训练个性化学生模拟器框架,解决了过去学生建模方法的问题。它经两阶段训练,在多领域实验中表现出色,还能为 AI 教师优化提供反馈。

机器之心
新闻资讯8

国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年

9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,在并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维度衡量存储系统性能,MeshFS兼顾性能与成本效率。

甲子光年
新闻资讯8

MiniMax ARR暴涨500%,token暴涨2000%!这就是Agent红利吧

MiniMax最新数据显示,今年8月ARR超8亿美元,较2月增长约5.3倍。2026年上半年收入同比涨283.1%,B端收入占比升至80%。其增长得益于用户增多和用法改变,M3、H3模型表现出色。

量子位
算法论文8

Agentic AI的第三种范式来了,16家机构提出「伴身智能体」

16家海内外高校与科研机构的22位研究者提出ComBodied Agents新范式,它围绕人的长期状态与主体性构建。论文给出闭环技术框架与评测标准,还提到研究难点与风险,也为产品实践提供指导。

机器之心
新闻资讯8

老黄斥资60亿美元,打造全球顶尖开源模型!

多家外媒爆料,英伟达计划斥资60亿美元打造全球最强开源权重AI模型。为此,英伟达买下Poolside的技术,挖走其核心团队,追加巨额投资。这让AI大模型竞争格局或变天,英伟达也将与大客户成对手。

新智元
新闻资讯7

突发!OpenAI停止强化学习训练两周

OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。

机器之心
算法论文8

不再止步于自然语言!PhiZero让世界模型学会「物理语言」

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
推荐文章8

Evolvent AI 胡梦康:Agent 可能会被模型吃掉,但帮助 Agent 进化不会

Evolvent AI 创始人胡梦康认为 AI 下一阶段是让模型自主迭代。公司搭建 Self - Evolving Agent Infrastructure,希望成 Agent 进化的数据基础设施供应商。胡梦康分享研究历程、对 Agent 方向判断及公司业务,探讨 Agent 数据等问题。

Founder Park
开源动态8

DeepSeek正式开源Harness:它终于有了自己的Vibe Coding入口

今晚,DeepSeek 正式发布并开源 DeepSeek Harness(DSH)开发者预览版,它是一套 Agent 运行框架。此前 DeepSeek-V4-Pro 上线,二者结合,Harness 负责将模型能力组织成可工作的 Agent,使 DeepSeek 进入相关竞争。

DeepTech深科技