「后训练技术」共找到 6046 篇相关文章

新闻资讯7

突发!美国解除封锁,英伟达可向中国销售H20 AI芯片

CNBC消息,美国政府向英伟达保证授予销售许可,将恢复对中国销售H20 AI芯片。此前该芯片受出口管制。黄仁勋加大游说,与特朗普会面后美态度转变,他还宣布新GPU,英伟达财报表现强劲。

AIGC开放社区
新闻资讯7

内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源

据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。

机器之心
新闻资讯7

差点被Ilya摁掉,胎死腹中!ChatGPT爆红内幕首次公开

本文深度揭秘ChatGPT爆红内幕,从产品发布、命名内幕到团队文化等方面展开。还提及OpenAI内部对发布的争议,以及ChatGPT发布方式的转变,同时指出依赖用户反馈改进模型存在的问题和OpenAI看重的人才特质。

新智元
新闻资讯7

苹果或搁置自研模型,转向依赖OpenAI或Anthropic

苹果正考虑用第三方AI模型驱动Siri,这是其在AI竞赛中的重大转向。目前苹果多为自研技术,评估外部模型项目已启动,虽未做最终决定,但或借此摆脱AI落后声誉。网友对此看法不一。

AGI Hunt
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。

Agent的潜意识
推荐文章7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ
产品应用8

模型即 Agent 的含金量:Kimi深度研究功能详评

作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。

歸藏的AI工具箱
产品应用7

纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口

纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。

Founder Park
开源动态8

南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。

AINLPer
新闻资讯7

AI教父Hinton:曾为了儿子卖身谷歌,如今担心AI 会毁灭人类

AI教父Hinton曾为给有学习障碍的儿子攒钱,将神经网络公司卖给谷歌。在谷歌他意识到AI可怕,离开后成AI风险大声疾呼者。他既担忧AI危害,也描绘了人类与AI共生的美好愿景。

AGI Hunt