「有监督微调」共找到 6465 篇相关文章

新闻资讯8

北京亮牌了:4500亿,要把AI卷到底

1月5日,'2026北京人工智能创新高地建设推进会'召开,透露北京要在AI上搞大动作。2025年北京AI核心产业规模预计突破4500亿,还将建AI创新街区,发布多项补贴政策,多家机构和企业有新成果。

AGI Hunt
产品应用8

全网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
新闻资讯8

官宣!前 OpenAI 华人科学家姚顺雨加入腾讯,大模型“系统战”开启!

12月17日消息,前OpenAI科学家姚顺雨加盟腾讯,任首席AI科学家等职。他是AI Agent与大模型推理领军人物,其加入是腾讯AI补强。腾讯还新成立三部门,标志战略向系统化工程建设进阶,混元也有不错表现。

AI科技大本营
新闻资讯7

对谈 Skyris 张宇诺:AI 陪伴机器人会飞,理所应当 | 00 后创业者系列

这是对 00 后创业者张宇诺的访谈,他介绍了 Skyris 会飞陪伴机器人的设计灵感、特点及优势,还谈及创业经历、对陪伴的理解,以及产品研发难题、规划等,最后提到 GAIR 2025 大会将邀 00 后 AI 创业者分享。

AI科技评论
产品应用7

一群年轻人,正在训练AI宠物的灵魂 | 甲子光年

文章讲述了芯宠工场团队训练AI伴宠Lito的过程。通过各种试验,Lito能做出预设外反应,其‘灵魂’在与人类互动中生长。团队面临功能与情感的抉择,市场上也有其他创业者挖掘AI情感陪伴赛道。

甲子光年
新闻资讯7

AI也能换岗了!Anthropic教智能体交接班,不怕长任务断片

Anthropic设计出长时智能体运行框架,让AI跨越数小时任务渐进式推进。其采用双智能体架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能体架构选择等开放问题。

新智元
新闻资讯7

万卡时代,企业需要怎样的算力集群?

过去两年,AI算力需求跃升,消耗从训练主导转向推理驱动。企业算力需求有突发性等特点,智算集群是关键方案。InfoQ联合腾讯云发起直播探讨,还介绍了算力供给缺口、集群构建交付、性能优化及演进方向。

InfoQ
算法论文7

MOE RL实战:统一FP8全流程训练

SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。

GiantPandaLLM
新闻资讯7

马斯克:AI 时代,别这样开会了

马斯克建议取消无价值的大型会议,而当下很多团队开会方式还停留在上个世纪。作者用超级麦吉处理马斯克3小时音频,它表现出色,还具备多种实用功能,与飞书妙记有本质区别,AI或让会议不必要。

AGI Hunt
产品应用8

小红书提出社交大模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位