「两阶段微调」共找到 1559 篇相关文章
WAIC最强亮点:非Transformer离线AI大模型已大规模量产,大模型商业比我们想得更快
在WAIC上,RockAI推出非Transformer离线AI大模型Yan 2.0 Preview,有视觉感知跃升和自主学习能力两大提升。该公司走非Transformer路线,着重场景落地,通过“标杆战略”推动产品量产,未来构想构建“群体智能”世界。
@所有开发者:Agent变现,阿里云百炼联合支付宝首创「AI打赏」!Agent Store全新发布
2025年是Agent元年,不过很多项目卡在POC阶段。6月25日阿里云百炼3.0全新升级,联合支付宝推“Agent打赏”功能,还上线Agent Store。此外,它升级多模态RAG和MCP能力,推出多模态交互开发套件。
骂战半年、站队失效,具身智能公司集体换了“新剧本”,VLA“自救”成功了吗?
2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索新架构,具身智能无完整技术路线图。
机器人看29s视频学会一个新技能,自变量开源HOST框架
自变量机器人开源的HOST框架,让机器人看29s人类示范视频就能学会新技能,原技能不受影响。它通过自定位级联预测,解决了人和机器人动作节奏、身体结构不同的问题,效率远超主流微调方案,推动机器人进家庭。
无锡梁溪国资领投!长三角商业航天再落关键一子
继4月数亿元Pre - A轮融资后,龙擎空天近日完成近亿元Pre - A+轮融资,由无锡梁溪国资平台领投。两轮融资用途明确,其‘终端 + 芯片’模式有独特优势,还启动‘算力上天’战略,折射商业航天产业变革。
全球首个完全AI编写的训练框架来了,速度反超英伟达:面壁要用 AI 把国产算力软件重写一遍
面壁智能发布全球首个全由AI编写的训练框架ForgeTrain,在华为昇腾系列上验证,速度超英伟达Megatron 10%。其构建分三阶段,目标是为不同需求“现场锻造”软件,还为国产算力软件生态赶超提供新思路。
跨本体、长任务、可预测……Motubrain双榜登顶只是一个开始
本文围绕具身机器人展开,指出当前大多具身机器人干活存在局限。Motubrain 双榜登顶,确立通用机器人大脑干活能力参照系,它具备一脑多能、一脑贯通等能力,生数科技已开启产品落地布局。
小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek
小米开源 MiMo-V2.5 和 MiMo-V2.5-Pro 两款模型,采用 MIT 协议,适合商业应用。在基准测试中表现出色,有竞争力价格和限时优惠。但与 DeepSeek 比,架构创新偏工程化,也有推理表现不足等问题。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
Skill 火了,但它可能只是个过渡品
大家认为给 Agent 装技能包是未来,但云玦科技的“零 Skill Agent”能自己造工具并碾压基于 Gemini 3 Pro 的 Agent。文章回顾 Agent 用工具三阶段,指出 Skill 是过渡品,不过现阶段仍实用,未来会进化。