后训练范式」共找到 4432 篇相关文章

开源动态8

NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!

继谷歌Banana,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。

开源星探
开源动态8

开源共建重塑推理 Infra:从架构创新到生态协同,Mooncake的破局之路

大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。

InfoQ
开源动态8

智源开源EditScore:为图像编辑解锁在线强化学习的无限可能

北京智源研究院团队发布 EditScore 高保真奖励模型系列,为图像编辑强化学习提供精确奖励信号。团队提出两步解决方案,开发出 EditScore 系列模型,其在多方面表现优异,还验证了两大应用场景,有深刻研究洞见。

机器之心
新闻资讯7

LangChain 完成新一轮融资,估值达 12.5 亿美元

LangChain 宣布完成新一轮融资,估值达 12.5 亿美元,由多家知名投资机构参与。它从单一 Python 包发展为综合性平台,产品矩阵丰富,客户众多。融资同时发布多项产品更新,资金用于产品和平台建设。

AI工程化
新闻资讯8

ChatGPT缔造者联手DeepMind大神,用AI攻坚高温超导,半个硅谷抢着投

OpenAI前研究副总裁Liam Fedus与DeepMind材料科学领军者Ekin Cubuk共创Periodic Labs,以3亿美元种子融资走出隐身模式。他们要打造「AI科学家」,构建自主实验室,攻坚高温超导等难题,获众多资本青睐。

新智元
算法论文7

AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了

来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进化方向。

机器之心
新闻资讯7

小红书 AI 搜索负责人高龑确认出席 QCon 上海,分享小红书搜索的 LLM 进化之路

10月23 - 25日,QCon全球软件开发大会将在上海举办,聚焦多热门话题。小红书AI搜索负责人高龑将分享《从“搜内容”到“问AI”:小红书搜索的LLM进化之路》,介绍搜索实践及大模型应用经验。

InfoQ
推荐文章8

2025 年 InfoQ 趋势报告:AI、ML 和数据工程

InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。

InfoQ
7

高盛研报:AI时代最大瓶颈不在算法和数据,而在电力和资本

高盛《Powering the AI Era》报告指出,AI是基础设施革命,其最大瓶颈是电力和资本。如一座250MW数据中心成本达120亿美元,2030年全球数据中心电力需求将激增,还介绍了应对办法及相关细节。

AI工程化
开源动态7

DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配

DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。

量子位