「专业开源模型」共找到 9141 篇相关文章

新闻资讯8

英伟达自毁CUDA门槛!15行Python写GPU内核,性能匹敌200行C++

英伟达发布CUDA 13.1,称是自2006年诞生以来最大进步。推出CUDA Tile编程模型,能用15行Python代码实现200行CUDA C++代码性能。芯片界传奇Jim Keller质疑其会终结CUDA“护城河”。

量子位
产品应用7

实测完豆包Seedream 4.5,替我设计师朋友哭了

火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。

量子位
新闻资讯7

AI跌价900倍,连一瓶矿泉水都比它贵!

过去一年,AI模型价格暴跌,不同层级降价差异大,如GPT - 3.5费用降280倍。但人们使用更频繁,引发AI版杰文斯悖论。同时人工变贵,且AI降价使权力更集中,引发价值重组。

新智元
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合性比人类高出50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象影响科研应用,在医疗等领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
推荐文章7

GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI

本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。

海外独角兽
开源动态8

Karpathy再放大招:8000行代码复现ChatGPT全栈,最低成本仅100美元,4小时跑完

Andrej Karpathy发布项目nanochat,是全栈式ChatGPT克隆体训练/推理流水线,代码约8000行,覆盖训练分词器、预训练等完整流程。介绍不同成本下模型表现,还回答网友关于架构、训练数据等问题。

AI寒武纪
新闻资讯7

清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元

来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与大模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。

机器之心
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。

AI寒武纪
算法论文7

研究表明:资深开发者在使用AI工具时,完成任务的时间比不使用时延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间比不使用时延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI
新闻资讯8

Gemini负责人爆料!多模态统一token表示,视觉至关重要

Gemini模型行为产品负责人Ani Baddepudi与谷歌AI Studio产品负责人探讨Gemini多模态技术,涉及设计理念、应用及发展方向。指出多模态对构建AGI重要,还介绍Gemini 2.5视频理解亮点与‘万物皆视觉’理念。

量子位