成本性能」共找到 6932 篇相关文章

开源动态8

100美元、仅8000行代码,复现ChatGPT,Karpathy:这是我写过的最疯狂的项目

特斯拉前AI总监Andrej Karpathy发布全新开源项目「nanochat」,是极简且完整的「从零构建ChatGPT」训练框架。不到12小时GitHub星标破4.2k。约8000行代码,花100美元、4小时就训练出专属「小ChatGPT」。

Founder Park
算法论文8

「有望为Transformer杀手」,谷歌DeepMind新架构MoR实现两倍推理速度

谷歌DeepMind发布新架构MoR,有望Transformer杀手。它统一实现参数共享、自适应计算,兼顾性与效率。实验显示其推理吞吐量提升,降低计算需求,但否取代Transformer存疑。

机器之心
新闻资讯7

以后手机不用插卡了?eSIM手机来了!

近期eSIM手机热点,它用电子化数据文件替代物理卡片,无需插卡就开通网络服务,让设备更轻薄。三大运营商获eSIM手机商用试验批复,暂不支持线上办理,苹果、华为等厂商机型将上市。

街头巷尾
新闻资讯8

Greg Brockman(OpenAI 联合创始人)把“那场宫斗”讲完整了:董事会、请愿书、马斯克与控制权

OpenAI联合创始人Greg Brockman做客播客,讲述公司“宫斗”内幕、与马斯克谈判细节等。还谈及模型力、算力瓶颈、AI应用等,如GPT 5.1到5.2有质的飞跃,算力将基本人权,AI推翻物理假设。

宝玉AI
算法论文8

RL 效率无损飙升 3 倍:厦大-Shopee-清华联合首创,将投机解码首次引入 RL,推理力稳如初!

传统RLVR训练中,rollout阶段耗时瓶颈。厦大 - Shopee - 清华联合团队提出SPEC - RL,将投机解码引入RL,训练提速2 - 3倍,避免重复生,与主流算法兼容,在多项基准测试中性稳定。

深度学习自然语言处理
开源动态8

开源Agent模型榜第一名,现在是阿里通义DeepResearch

阿里开源首个深度研究Agent模型通义DeepResearch,在多权威评测集上超越多个Agent模型。它采用多阶段数据策略,有两种推理模式,革新训练流程,已赋高德出行Agent和通义法睿等应用,且模型等均已开源。

量子位
产品应用8

解密谷歌 NotebookLM 技术幕后【上】:知识如何被“转译”为 AI 对话式播客

NotebookLM是Google推出的AI知识工具,将文档、网页等内容转化笔记、播客、视频等。文章探秘其技术,解析AI音频播客与视频生力,还给出构建音频播客生器的实践流程。

AI大模型应用实践
开源动态8

清华等发布UltraRAG 2.0,仅用50行代码解锁RAG高性开发

大语言模型存在“知识截止”问题,RAG技术应运而生,为大模型落地主流方案。但随着需求提升,其工程实现变复杂。清华等推出UltraRAG 2.0,仅50行代码实现同等功,降低开发门槛,性提升,还落地多种场景。

AIGC开放社区
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理力贼强~

智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试助力科研各阶段,还介绍了其架构设计与训练策略。

CourseAI
新闻资讯7

谷歌Gemini闹乌龙:我家狗子,竟被AI开除了「狗籍」!

2025年10月谷歌让Gemini for Home接管智家居生态。它识别人脸、快递等,还会生家庭日报。不过,它也闹了把狗认猫的乌龙。谷歌正改进识别准确度,这也是智家居竞争中的小插曲。

新智元