智能体训练」共找到 5155 篇相关文章

产品应用8

Thinking Machines发布首个产品Tinker :大模型后训练彻底变天

OpenAI前CTO Mira Murati的Thinking Machines公司发布首个产品Tinker,这是为微调大模型设计的灵活API,能简化LLM后训练过程,让用户专注算法和数据,平台处理分布式训练。它有多种特性,已被顶尖机构采用。

AI寒武纪
新闻资讯8

重磅发布 |多智能协同驱动,新一代流力学工业软件平台正式亮相!

2025年11月29日,第四届智能力学产业联合大会上,西北工业大学等联合发布“多智能协同驱动的新一代流力学工业软件平台”,解决流设计仿真瓶颈,含完整系,有多项关键技术及典型应用场景。

力学与人工智能
产品应用8

CES 新爆款!追觅具身智能扫地机,打破「人形唯一论」

CES上,追觅具身智能扫地机成爆款,它打破“人形唯一论”,采用四足轮腿和双臂结构,能完成多种家务及养老关怀功能。它基于深厚积累且研发投入高,有望成家庭具身智能优选。

新智元
推荐文章8

AI Agent的“祛魅与归真”:当超级智能开始懂行|甲子光年

AI Agent正迎来“祛魅”时刻,市场关注焦点从“模型有多大”转向“业务有多懂”。甲子光年智库分析,其角色进阶为“数字员工”,重塑人机协作模式。众安信科深耕企业级场景,构建闭环系,其AI Agent成效显著。

甲子光年
开源动态7

VeRL-Omni:面向扩散和全模态生成模型的通用RL后训练框架

VeRL-Omni是面向多模态生成模型的通用RL后训练框架,覆盖多种架构。它有高效多模态rollout、灵活奖励引擎等特性,支持多种硬件,团队还验证了不同训练方式,后续将扩展模型与算法支持。

机器之心
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
新闻资讯8

刚刚,小扎成立「超级智能实验室」!11人豪华阵容曝光,华人占多半

小扎官宣Meta「超级智能实验室」(MSL)成立,合并内部三大AI团队,28岁Alexandr Wang任首席AI官,公布11人豪华团队名单,团队多来自谷歌、OpenAI等大厂,目标开发超级智能

新智元
推荐文章8

多模态大语言模型的核心技术架构与训练方法的进化

文章深入剖析多模态大语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创新及开源模型OpenVLA。

AIGC开放社区
开源动态8

智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了

智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。

AI工程化
推荐文章8

万字长谈丨同济工智院华先胜:工程智能,是 AI 的「成人礼」

雷峰网·AI科技评论对话同济工智院华先胜,探讨工程智能。他认为工程智能是AI与工程深度融合,要从数字走向物理世界,构建系,实现人机共生,还介绍了研究院成果、灵感计算及操作系统架构等。

AI科技评论