三段式后训练」共找到 3751 篇相关文章

新闻资讯8

30万被引的AlphaGo之父,创业4个月融资近百亿元!笃信RL实现ASI

4月27日,AlphaGo之父David Silver创办的Ineffable Intelligence获11亿美元种子轮融资,投估值51亿美元。该公司押注强化学习和自我经验学习,试图挑战大模型主线。未来或采用大模型预训练和强化学习混合路线。

新智元
推荐文章7

微软副总裁X上「开课」,连更关于RL的一切,LLM从业者必读

微软副总裁 Nando de Freitas 在 X 上「开课」,分享人工智能教育帖子,从 LLM 的强化学习讲起。内容涵盖无监督、监督、强化学习定论,分布式强化学习系统构建,RL 用于训练 LLM 等,还介绍单步强化学习与策略梯度及相关技巧。

机器之心
新闻资讯7

Gemini 3.5 Pro绝密泄露,前端赶超Fable 5!

全网被Gemini 3.5 Pro泄露刷屏,传闻7月17日发布。它在前端生成表现出色,一次成型、精准零失误,性能超Fable 5,但在硬核推理等任务上不如Fable 5和GPT - 5.6。谷歌为其重预训练,还准备对标GPT - Image 2的图像模型。

新智元
开源动态8

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型

360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在多业务落地并开放API。

机器之心
新闻资讯8

在「外滩大会·具身智能:从泛化到行动,重塑产业未来」上,这些大牛都说了什么?

9月11日,机器之心联合出品的外滩大会见解论坛聚焦具身智能。多位学界和业界代表分享看法,如孙富春称训练场可破数据瓶颈,江磊指其是新型数据工厂。思辨和圆桌环节探讨技术路线、应用场景等关键问题。

机器之心
推荐文章7

告别模板时代!妙多VP张昊然:生成式AI如何驱动UI设计的范式革命

在AICon2025上海站,妙多副总裁张昊然分享生成式AI在UI设计领域的影响。他回顾初代生成式UI的‘套模板’技术,讲述技术革新回归代码生成界面,还探讨让AI理解设计系统、妙多AI 2.0理念及未来UI工具假设。

InfoQ
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输全量微调

Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face
产品应用8

今年最难的机器人Demo,“机器人含量”为0

自变量发布全新灵巧操作系统TwinDex,训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。

量子位
新闻资讯7

先进封装补完计划

2024年美国众议院点名批评美资对盛合晶微投资,将先进封装列为投资禁区。盛合晶微由中芯国际和长电科技合资成立,攻克硅中介层难题。AI芯片变大使台积电产能紧张,盛合晶微为国产芯片提供新选择。

远川科技评论