「开源深度学习框架」共找到 4624 篇相关文章
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
Thinking Machines Lab获20亿美元,没发布任何产品
前OpenAI首席技术官Mira Murati创立的Thinking Machines Lab获20亿美元种子轮融资,对该保密公司估值达120亿美元。投资者众多,公司将在未来几个月推出含开源组件的首款产品,还会分享科研成果。
上班后重新开始练口语,并获得了价值感
作者分享上班后用AI练口语的经历,称能无痛坚持,还获得价值感。介绍了AI练口语比线上外教课的优势,如免费、时间灵活等,也分享利用AI练口语的方法,如选话题、当场学习等。
刚刚,国产Agent模型闯入全球第一梯队!限时免费
昆仑万维发布SkyClaw-v1.0及其轻量版SkyClaw-v1.0-lite Agent模型,性能达全球第一梯队,价格仅主流顶尖模型一半甚至更低,适配主流Agent框架,还兼容OpenAI接口,现限时免费,后续将逐步开源。
性能超越李飞飞,他们把10亿高斯点的3D世界装进浏览器
群核科技开源3D高斯浏览器Aholo Viewer,渲染速度和大场景加载性能超Spark2.0,能让任何设备浏览器流畅运行10亿+粒子的超大3D场景。它还带动信息载体范式跃迁,推动AI理解三维世界。
首钢园具身智能持续进化!他山科技携手图灵奖顶尖学者激活数字科创“触觉引擎”
当具身智能成下一代AI核心战场,他山科技签约图灵奖得主理查德·萨顿教授,通过“机器人幼儿园”模式探索进化路径。其自主研发触觉感知技术,与萨顿强化学习理念结合,为具身智能发展提供新思路。
Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死
当Ilya断言大模型未来在于架构创新时,中国团队推出全球首个可大规模落地的开源原生多模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。
2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接」
作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同时探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。
算力成本大降!马尔可夫思考机来了,LLM推理成本直接降为线性
用强化学习让LLM具备推理能力耗费颇高,计算量会二次级增长。Mila和微软研究院等团队提出马尔可夫式思考机,重构强化学习形式,让计算量呈线性,实验效果显著,还能与先进模型兼容。
大模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠
阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。