「模型可解释性」共找到 10038 篇相关文章

产品应用8

GPT-5.2技术炸场!6大核心突破,办公效率拉满

OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6大核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。

CourseAI
算法论文8

这些大神在Meta的论文看一篇少一篇了

田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。

量子位
新闻资讯8

GPT-5.1发布当天,文心5.0杀回来了

2025百度世界大会发布文心5.0,这一2.4万亿参数的原生全模态模型,训练之初融合多模态数据,支持联合输入输出。同日OpenAI推出GPT - 5.1,文心5.0在多方面表现出色,如情绪安抚更贴心、多模态理解能力强等。

新智元
新闻资讯8

OpenAI入股AMD,股价暴涨35%!奥特曼左手黄仁勋,右手苏姿丰,通吃全球算力

OpenAI宣布与AMD达成战略合作,将部署6GW的AMD Instinct MI450 GPU集群,可认购最多1.6亿股AMD普通股,持股比例或达10%。消息公布后,AMD盘前股价飙升35%。此前OpenAI也官宣与英伟达合作。

新智元
推荐文章8

GPT-5 = Scaling Law失效?毕树超:永远有效,因为它反应的是数据结构,客观规律

Shuchao Bi在哥大演讲阐述AI发展。回顾自监督与强化学习路径,指当前发展遇高质量数据瓶颈,认为Scaling Law不会失效。还探讨通往AGI面临的问题,畅想AI重塑世界,提出两个理解AI发展的心智模型。

AI寒武纪
新闻资讯9

Jev爆火硅谷!哑巴AI卷疯14万开发者

ChatGPT核心发明人Diogo Almeida离职OpenAI后推出不会生成文字的大模型Jev,发布3天就被主流平台集成,14万开发者涌入内测,提出行业旧路径跑偏,打造只做决策的新型AI,主打极速低成本零幻觉。

新智元
推荐文章7

AutoResearch-LLM:让 Agent 接手 LLM 训练优化

本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。

阿里云开发者
新闻资讯8

20亿砸向00后创业机器人公司!估值一年暴涨7倍,国家级资本重仓

近日,灵初智能完成约20亿元天使轮及Pre - A轮融资,资金将用于物流场景落地与数据采集体系建设。其团队互补,突围逻辑是All in人类原生数据,自研采集方案,走“模型驱动数据”路径,定位“大脑驱动公司”。

量子位
新闻资讯7

马斯克官宣数字AI员工!世界首富也来养龙虾,测试阶段员工把它当真人

马斯克在X上宣布数字擎天柱/巨硬AI项目,它是能在电脑自动操作的数字员工,可模拟公司运作。该项目早有记载,此前印度小哥曾爆料。巨硬项目曾遇阻,现以数字擎天柱形式推出,由xAI与Tesla联合打造。

量子位
产品应用7

理想首款AI眼镜,只卖1699元

理想推出首款AI眼镜Livis,售价1699元起,整备重仅36g,续航18小时。它能控车、有头枕音响,还可拍照录像。采用流式智能语音框架,核心亮点是理想同学语音助手,意在构建以车为核心的AI生态。

量子位