「OpenAI o3」共找到 3804 篇相关文章
LeRobot v0.4.0 正式发布:全面提升开源机器人的学习能力
LeRobot v0.4.0 正式发布,带来多方面重大升级。有可扩展的 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、多 GPU 训练简化等特性,上线了机器人学习课程。
Dia 没死,人家转手就发了 1.x 版本
OpenAI 发布浏览器 Atlas 引发讨论,有人认为其有缺陷会失败,也有人觉得初创 AI 浏览器会被巨头收割。以 Dia 为例,它被收购后加快迭代,推出 Skills Gallery、Research 等功能,还新增连接 App 等特性。
2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里
GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻量级文档解析模型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。
阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元
阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。
2.1K星CCPM:多Agent任务,流水线一样并行Coding
CCPM基于GitHub Issues + Git worktrees,有严格五阶段流程。多agent负责同一issue不同子任务,实现任务级并行,最高提升3倍交付速度,75%降低Bug率,还能避免上下文丢失等问题,有详细工作流程和命令。
PyTorch博客翻译 Accelerating Generative AI Part III: Diffusion, Fast
这篇博客介绍用纯原生 PyTorch 技术将文本到图像的 diffusion 模型(特别是 Stable Diffusion XL)推理速度提升高达 3 倍的方法,讲解五种优化技术,还验证了方法在其他 diffusion 模型上的通用性和有效性。
强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!
科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。
Kafka 网络成本失控?如何彻底根除 AWS、GCP 上的 Kafka 网络隐性成本
云原生架构普及,企业将 Apache Kafka 部署到 AWS、GCP 等公有云,跨可用区数据传输成本成“隐形杀手”。AutoMQ 是新一代云原生 Kafka,100% 兼容 Kafka 协议,其“零成本复制”技术可降本,已在 GitHub 开源。
纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口
纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。
真急了!AI落后、Siri彻底输给ChatGPT,拯救苹果全靠她?
据彭博报道,苹果今年接触OpenAI前CTO Mira Murati,讨论与Thinking Machines Lab交易意向。苹果收购策略保守,但AI浪潮下自研已落后,它或需收购补足短板,除该实验室,还关注Cohere等小公司。