「原生多模态推理」共找到 3095 篇相关文章
跳出英伟达生态:OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒
OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。
马斯克深夜点赞!内容的下一站是:玩!
马斯克深夜点赞用 Loopit 制作的互动 meme,引发关注。Loopit 让用户体验从‘看’变‘玩’,实现双向交互。其融合 AI Coding 与多模态生成,构建 Runtime,解决延迟、状态同步等问题,潜力大。
Qwen3满血版上线,第一件事就是把搜索按钮干掉了。
Qwen3-max满血版发布,去掉搜索按钮,因模型能力提升无需手动控制。它具备自适应工具调用能力,能自行判断何时使用搜索等工具,思考过程结构化,跑分接近一线模型。
真没招了!Claude撞碎创业梦,华人博士开源逆袭
Claude Cowork发布砸了Guohao Li的创业梦,他将Eigent项目开源。他对multi - agent架构工程化重构,打造全栈本地Agent,其分布式设计、沙盒终端、推理层优势明显,引发社区关注。
首个AI同事正式「入编」!CES 2026超级组织引爆
2026 CES大会上AI成核心主题,出门问问带来TicNote家族‘全家桶’。TicNote Cloud以项目为核心,让AI成团队协作者,其搭载的Shadow AI 2.0能力升级,配合硬件构建端到端工作流,开启协作4.0时代。
从组件到 OS 的跃迁,MemOS 深度拆解:构建企业级 Agent 的高性能记忆底座【上】
本文深入剖析开源记忆方案MemOS,它将记忆从“外挂组件”升为“系统资源”。介绍其设计理念、核心架构,分析记忆需加工、分层调度和治理的原因,还阐述记忆三态及流转,最后展示MemOS Cloud的使用方法。
微软预览 Foundry Agent Service 长期记忆功能,简化状态管理
在年度 Ignite 大会上,微软宣布公开预览 Foundry Agent Service 中的记忆功能,这是全托管长期记忆存储,与代理服务原生集成。开发者可存储、检索和管理关键上下文,系统自动处理复杂“管道”。
智谱 GLM-4.7,Coding 开源第一,其他也很强
智谱正式发布并开源专为 Agentic Coding 打造的 GLM-4.7 模型,编程、推理、Agent 能力成绩亮眼,价格比 Claude Sonnet 4.5 更优。还推出 Coding Plan 套餐,使用方式多样。发布前几天,智谱港股招股书挂网。
不想再折腾 ELK?上手体验,程序员自建监控新选择,前端埋点 + 后端日志 + 链路追踪,一套开源栈全包了
OpenObserve 是云原生开源观测平台,用一个服务搞定日志、指标等监控与可视化,能解决监控栈散、部署复杂、存储贵的问题,号称日志存储成本比 ES 降至约 1/140,功能亮点多。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。