后训练方案」共找到 4393 篇相关文章

产品应用8

字节发了个机器人全能大模型,带队人李航

字节推出Seed,其Robix视觉—语言单模型能搞定机器人推理、任务规划和自然语言交互,核心采用思维链推理和三阶段训练策略,效果超Qwen2.5 - VL、GPT - 4o等,负责人是李航。

量子位
推荐文章7

硅谷惊变:12万张H100的挽歌

这是虚构故事,Meta用12万张英伟达H100训练“LLaMA 4 Maverick”,却被中国杭州DeepSeek团队用2000张GPU打败。项目失败成丑闻,扎克伯格成立实验室四处收购遇冷,新负责人管理混乱,实验室乌烟瘴气。

宝玉AI
产品应用7

Jina 第4版:多模态向量检索,统一适配,挑战3大任务

Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务性能。

CourseAI
新闻资讯7

AI 开发工具的隐形战场:新一轮 IDE 之争打响!

在AI开发工具领域,VSCode成主战场,但背有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。

AI科技大本营
新闻资讯8

Demis Hassabis:AGI 还缺什么,智能体到底行不行,下一个科学突破长什么样

Google DeepMind CEO Demis Hassabis 做客直播,探讨当前 AI 范式距 AGI 差距、智能体水平、科学突破模式等话题。指出当前范式或需关键突破,记忆方案待优化,AlphaGo 技术复活,还给出创业建议。

宝玉AI
算法论文8

EvoSkills:自进化的skill,是好skill

文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。

PaperAgent
算法论文8

微软OEL框架:大模型一次部署,终身进化

微软最新论文Online Experiential Learning (OEL)提出让LLM在真实部署持续自我进化的框架,无需人工标注等。介绍了在线体验学习的必要性、OEL方法论及实验验证,揭示关键洞察与启示。

PaperAgent
新闻资讯7

字节做了个 AI 手机,钉钉做了台 AI 主机

2025 年末 AI 硬件圈热闹非凡,月初豆包 AI 手机上线刷屏,因平台风控引发讨论。近日,钉钉发布 AI 主机 DingTalk Real,定位 AI Agent 执行载体,还推出 AgentOS 统一调度,已跑通多企业场景。

机器之心
新闻资讯7

意图是 AI 时代的新入口|AGIX PM Notes

文章围绕AI时代展开,指出互联网时代商业模式核心是“入口”,AI时代应关注“意图”。还提及上周对冲基金资金流动、AI企业动态,如微软推安全方案、Alphabet合资开发机器人等。

海外独角兽
新闻资讯8

昆明城市专区展览里的科技与生活

2025年国家网络安全宣传周在昆明开幕,同期昆明城市专区展览开展。展示了昆明数字经济成果,如AI机器人、网络安全体系建设、公安AI数字人等,还有鲜花、咖啡产业数字化及各企业安全方案

街头巷尾