「小模型性能」共找到 8886 篇相关文章

新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
新闻资讯7

Python新版本去GIL刷屏,Karpathy 点赞敢死队,Python 之父:冷静,别神话并发

Python 3.14 正式发布,将“去 GIL”写进官方发行版,带来自由线程支持等能力,预估性能提升 3% - 5%。开发者看好,Karpathy 点赞,但 Python 之父认为去除 GIL 重要性被高估,强调工程常识。

AI前线
新闻资讯7

苏姿丰出手!Oracle下单5万颗AMD芯片,英伟达王座撼动

Oracle宣布2026年第三季度起在云基础设施部署5万颗AMD Instinct™ MI450系列GPU构建AI超级集群并持续扩容。AMD Instinct MI450系列GPU亮点多,此次合作是其与Oracle合作的深化,也被视为AMD挑战英伟达的关键突破。

新智元
开源动态8

清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源

清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。

机器之心
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
新闻资讯8

OpenAI奥特曼认错:我天生不适合管理公司

OpenAI CEO奥特曼在a16z采访中回应热点问题,阐述三大核心战略,谈及Sora 2等热点话题,还称自己不适合管理公司。他提到目标、对垂直整合看法、Sora与AGI关系等内容。

量子位
算法论文8

超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强

RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。

AIGC开放社区
新闻资讯7

AI产品能不能火,全看创始人会不会当“网红”?这届AI大佬不拼代码了,个个都是隐藏的社交媒体达人

本文指出当下AI创业者纷纷成社交媒体达人,利用小红书等平台为产品冷启动。还强调社交传播对AI产品至关重要,但不能替代技术壁垒。同时分析初创公司应深耕场景,抓住时间差打造竞争力。

AI前线
推荐文章7

人生周报v044:费曼

文章围绕AI应用展开,指出人机交互是AI应用竞争壁垒,介绍典型案例及交互形态,分析Agent不同场景,还提及AI应用创业要素,最后推荐《费曼经典:一个好奇者的探险人生》。

李继刚
7

全球价值最高创企诞生,OpenAI估值创纪录来到5000亿美元

几天前OpenAI发布视频大模型Sora 2,获Altman盛赞。据彭博社,OpenAI完成交易,员工可按5000亿美元估值售股。年初其估值3000亿美元,此次提升突显其用户与收入快速增长。

机器之心