垂类Agent训练」共找到 4622 篇相关文章

开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
开源动态9

开源Top2!实测阶跃Step 5 Preview,真有点猛啊…

本文是量子位作者对阶跃星辰新发布的开源旗舰大模型Step 5 Preview的实测与解读,介绍了其参数架构、评测排名、成本优势,展示了多类任务实测效果,分析了技术路线与行业价值。

量子位
算法论文8

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。

机器之心
新闻资讯7

The Batch: 973|Claude 的水印如何运作

Anthropic将在2026年8月2日后发布的Claude模型全球部署肉眼不可见、机器可读的水印,用于表明文本和图像由其生成。该技术基于Google的SynthID - Text,不过此公告引发广泛争议。

DeeplearningAI
开源动态8

1.9K Star!给 DeepSeek Harness 装上侧边工作台,文件、终端、Git、浏览器、插件一屏搞定!

DeepSeek Harness 是 AI Agent 运行框架,自由度高但默认 Web UI 操作不便。社区插件 DSH - better - sidebar 迅速出圈,装了侧边工作台,整合多样工具,更新勤,适合折腾 DSH 的人。

开源星探
开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
开源动态8

一个月暴涨3K star,这是我见过最好用的AI生成PPT项目了!

职场人做PPT常耗在调格式等方面,现有AI工具多有缺陷。`dashi-ppt-skill`项目可生成网页版PPT编辑器,有多种主题、版式和控件,功能丰富,能本地完成操作,还介绍了安装和使用方法。

开源先锋
推荐文章7

从0到1带你速通Codex,我整理的终极保姆教程来了。

作者重写Codex教程,介绍安装、界面、设置等内容,还展示开发网页和APP过程,最后指出Mac版功能比Windows版丰富。

数字生命卡兹克
开源动态8

解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”

大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。

机器之心
新闻资讯7

独家|地平线前高管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万元投资

《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万元种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多元场景。

AI科技评论