开源通用智能体」共找到 6095 篇相关文章

产品应用8

通用级PixVerse P1的技术突破,揣着进入平行世界的密码

PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。

机器之心
开源动态8

阿里重磅开源:端到端VLM文档解析模型,图片直出结构化HTML!

在AI文字识别类应用中,文档解析常不尽人意。阿里开源端到端文档解析模型Logics - Parsing,基于VLM,能图片直出结构化HTML,有统一、智能、精细等亮点,还给出使用步骤。

开源星探
开源动态7

11 万 Star 的开源项目,给 AI 编码代理补流程,这套 Superpowers 值得装

110多K Star的开源项目Superpowers,是完整软件开发工作流程,基于17个可组合“技能”。它采用Pull模式,用苏格拉底式追问澄清需求,工作流覆盖多领域,支持多平台,一行命令即可安装。

AI进修生
开源动态8

论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster

本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。

量子位
新闻资讯7

DeepMind大佬最新暴论:单体大模型穷途末路,未来买的不是模型,是"智能路由"

DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。

AI寒武纪
开源动态8

2M大小模型定义表格理解极限,清华大学崔鹏团队开源LimiX-2M

大语言模型在结构化表格数据处理上表现不佳,清华大学崔鹏团队开源的 LimiX-2M 模型,仅 2M 参数,却能同时支持分类、回归等任务,性能超越经典模型,且训练、运行成本低,科研友好。

机器之心
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
产品应用8

智元首发SOP系统:打破离线训练瓶颈,让具身智能在“干中学”

2025年VLA让机器人有通用性,但真实部署存问题。智元机器人具身研究中心提出SOP在线后训练系统,融合在线学习等,使机器人在真实环境持续进化,实验显示其能提升性能、效率,突破VLA瓶颈。

量子位
推荐文章8

从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」

今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。

机器之心
开源动态8

阿里开源PromptEcho:用冻结多模态大模型为文生图训练提供高质量Reward

阿里团队提出PromptEcho方法,无需标注和训练reward模型,仅通过冻结多模态大模型(VLM)的一次前向推理获高质量reward。实验显示其在文生图和电商海报文字渲染任务效果佳,且已开源相关代码等。

机器之心