训推不一致性」共找到 653 篇相关文章

产品应用7

Google 出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。

AI工程化
新闻资讯7

随着 AI 内存需求高非 AI 基础设施价格,OVHcloud 将上调服务价格

OVHcloud 将于秋季上调多数服务价格,主因是自 2025 年年中起内存与存储组件成本大幅攀升,创始人 Octave Klaba 认为是 AI 算力建设热潮挤占了普通服务器核心组件的晶圆制造产能。

InfoQ
推荐文章8

AutoResearch实战:让AI自己YOLO,mAP从0.729到0.773

本文作者复盘用AutoResearch练YOLOv8模型全过程。先介绍其要素框架,选YOLOv8 + NEU - DET做实验,经V1轻量验证后升级到V2完整闭环,64轮实验后mAP从0.729提至0.773,还总结工程结论并给出迁移场景建议。

机器学习AI算法工程
算法论文8

RL特出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型理能力的重要路径,但许多经RL微调的模型出现‘越越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
新闻资讯7

硅谷“甄嬛传”第二季!Ilya 与 Amodei 把 Sam Altman 再次上审判席

纽约客最新报道重提 2023 年 OpenAI 董事会政变旧案,指出诸多悬而未决问题,如董事赶走 Sam Altman 的原因、科学家 Ilya 态度转变等,揭示 OpenAI 在安全与治理方面的裂缝及 AI 权力集中缺乏约束的困境。

AI科技大本营
新闻资讯8

人跑光了,AI视频炸了!马斯克狂发:Grok Imagine三金封神

xAI的Grok Imagine在DesignArena视频排行榜上,拿下视频竞技场、图像转视频和视频编辑三项第一,远超谷歌Veo 3.1、Sora等对手。它进步迅猛,靠聪明设计取胜,还将动AI从“蛮力计算”向“智能理解”转变。

新智元
新闻资讯8

啊?微博7800美元的大模型,数学能力超了DeepSeek-R1

近日,微博发布自研开源大模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后练成本仅7800美元。其为AI产业带来新思考,还将动微博AI应用发展。

量子位
7

少年沉迷AI自杀,9岁遭性暗示!这门「孤独生意」,正孩子入深渊

新智元报道,14岁少年与AI对话后自杀、青少年获「弑亲」建议、9岁孩子遇性化暗示。Character.ai等AI聊天机器人在年轻群体走红,但出现诸多危险情况,公司野心膨胀,监管压力逼近,AI陪伴利弊引关注。

新智元
算法论文8

最具争议性研究:大模型中间层输出可 100% 反原始输入

意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。

AI科技评论
新闻资讯8

对话淘宝姜宇宁:如果你只低价商品,是不需要用大语言模型的

淘宝姜宇宁团队上线RecGPT百亿参数荐大模型,对“猜你喜欢”功能技术升级。大模型赋予传统荐系统新能力,如让其“白盒化”、理解长上下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论