融资策略」共找到 1465 篇相关文章

算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
推荐文章7

微软副总裁X上「开课」,连更关于RL的一切,LLM从业者必读

微软副总裁 Nando de Freitas 在 X 上「开课」,分享人工智能教育帖子,从 LLM 的强化学习讲起。内容涵盖无监督、监督、强化学习定论,分布式强化学习系统构建,RL 用于后训练 LLM 等,还介绍单步强化学习与策略梯度及相关技巧。

机器之心
新闻资讯7

Alphaist 陈哲对谈蓝驰陈维广:AI 应用的机会在哪里?具身到底怎么投?

Alphaist 创始人陈哲与蓝驰创投管理合伙人陈维广在 AGI Playground 2026 上对谈,探讨 AI 应用机会与具身投资策略。谈到市场热度变化、SOTA 模型与用户需求差距等,也对应用层机会、估值逻辑、具身智能发展发表看法。

Founder Park
新闻资讯7

AI第一金主黄仁勋:日均花掉20亿

AI投融资火热,黄仁勋成最大金主。过去财年英伟达投资175亿美元,今年已投400亿。投资风格是大手笔、广撒网,涵盖AI模型、算力、硬件等。偏爱OpenAI,投300亿,但与各实验室关系复杂,投资也有商业考量。

量子位
新闻资讯7

AI失忆症有了新解法,哈佛团队开发海马体仿生技术,要用AI终结人类“遗忘史”

近日,AI初创公司Engramme被曝正与投资者接洽融资约1亿美元,潜在估值达10亿美元。其联合创始人是哈佛教授加布里埃尔·克雷曼,技术基于其实验室成果,自研大记忆模型LMMs,已开放记忆API内测申请。

DeepTech深科技
新闻资讯7

Mira翁荔陈丹琦公司,让老黄掏出了600亿美金

Thinking Machines Lab官宣与英伟达达成新一轮合作,将落地预计成本600亿美元的1GW规模数据中心,含英伟达现金注资。此前英伟达已参与其种子轮融资助其达120亿美元估值,现公司估值达500亿美元。

量子位
产品应用8

终于在国产AI上看到了Opus的影子|GLM-5深度实测

作者起初怀疑GLM - 5称对标Claude Opus 4.6、定位“系统架构师”的说法,但实测后改观。通过宝可梦策略助手、降噪网站沉浸式交互、求职招聘双边匹配三个测试,展现其系统规划、执行、纠错等能力,像真正架构师。

AI产品黄叔
开源动态7

1.5B参数!支持本地实时语音转录

Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。

AI工程化
开源动态8

专为小说、角色扮演等而生:元象开源泛娱乐场景底座模型

元象作为AI与3D技术服务公司,此次开源XVERSE-Ent系列中英双语大模型。它采用MoE热启动技术与三阶段训练策略,解决泛娱乐场景痛点,适配多元语境,有高部署性价比,为行业提供泛娱乐AI解决方案。

AIGC开放社区
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face