「图文混排Agent」共找到 2827 篇相关文章
企业级OpenClaw最强拍档来了!万亿参数的国产多模态大模型,刚刚开源发布
YuanLab.ai团队开源源Yuan3.0 Ultra多模态基础大模型,是万亿级开源多模态大模型之一。它优化训练效率,在多任务表现突出,为企业Agent AI提供支撑,还提出新算法和训练策略,全面开源推动落地。
我们给OpenClaw加了一双眼睛,来观察我们这平凡的一天。
内容创意组小伙伴用Pocket 3作OpenClaw的“眼睛”,俯拍工位区,截取图片喂给多模态模型描述场景,下班时让OpenClaw分析趣事。还开发了“OpenClaw人类观察计划”,开发过程简单,降低了Agent体验门槛。
阶跃新模型快到“没推理”!印奇上任,果然气势一新
印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。
当 GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力
全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率低,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。
百万人围观,「上下文图谱」火了,万亿美元新机遇?
本文围绕智能体对记录系统的影响展开讨论。有人认为智能体将摧毁记录系统,也有人反驳,指出其会提高记录系统标准。文章重点介绍上下文图谱概念,它是决策轨迹的长期积累,有望成万亿级新机遇。同时分析传统厂商构建难题及创业公司路径。
12月,我们推荐这 7 款 AI 新品
极客公园创新大会为7款AI新品策划线下发布会。包括笔记产品flomo、AI相机Doka等,各产品创始人分享理念,如flomo不做AI润色,Doka让AI仅作拍照辅助等。
LangChain 彻底重写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值
本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的重写。它最初是副业,后成热门开源项目,此次重写解决了过往问题。
论文深度解读:大模型(LLM)加持下的自主无人机分层智能体框架,实现自主规划
文章解读《A Hierarchical Agentic Framework for Autonomous Drone-Based Visual Inspection》论文,介绍分层智能体框架让无人机群自主规划。研究对比三种‘思考模式’与不同‘大脑’组合,还指出未来研究可开发混合系统、混合能力智能体及自适应系统。
OpenAI和DeepMind大佬离职联手,誓用AI科学家实现室温超导!已融3亿美元
OpenAI后训练负责人和DeepMind的AI4S大佬离职成立Periodic Labs,专注用AI Agent改造科研,攻克室温超导等难题,已获3亿美元融资。团队目标是培养AI科学家,构建自主实验室,还将应用于产业。
腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态大模型
多模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。