「3D场景理解」共找到 4196 篇相关文章
通义灵码编程智能体,上线!
近期 Qwen3 正式发布并开源 8 款「混合推理模型」,表现出色。通义灵码全面支持 Qwen3 并上线编程智能体,具备多种能力,支持配置 MCP 工具,集成魔搭 MCP 广场,能大幅提升开发效率。
信通院&清华提出FedRE:用「纠缠」搞定联邦学习三难困境 | CVPR 26
联邦学习中兼顾模型性能、数据隐私和通信开销是挑战,尤其在模型异构场景。信通院和清华联合团队提出FedRE框架,能适配异构与同构场景,保证性能同时保护隐私、降低开销。
AI时代终端大变局
随着算法、芯片、场景深度融合,端侧AI计算成终端智能化核心引擎,重塑IoT终端应用场景智能体验。端侧AI芯片作为技术底座,正重塑终端产业格局,虽面临挑战,但未来前景广阔。
华为超节点:用「一台机器」的逻辑,驱动AI万卡集群
在华为全联接大会2025上,华为基于自研灵衢互联协议创新超节点架构,重新定义大规模有效算力新范式。它能解决传统集群通信问题,还推出覆盖全场景的产品组合,并强调‘硬件开放、软件开源’生态战略。
GPT-5.2刚发布就要被网友玩坏了~
11月19日Gemini-3-pro发布,一周抢1200万用户,OpenAI市值受威胁,GPT-5.2提前上线,专注推理、速度和削减幻觉。文中介绍其技术要点,也展示网友实测情况,如被Gemini-3.0碾压等。
GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI
本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。
12ms!一个仅8M的语音停顿检测模型
语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。
AI Agent的“祛魅与归真”:当超级智能体开始懂行|甲子光年
AI Agent正迎来“祛魅”时刻,市场关注焦点从“模型有多大”转向“业务有多懂”。甲子光年智库分析,其角色进阶为“数字员工”,重塑人机协作模式。众安信科深耕企业级场景,构建闭环体系,其AI Agent成效显著。
Parlant:一个让AI Agent 真正听话的开源框架
AI Agent存在不听话的痛点,Parlant开源框架专门解决此问题。它与传统方法不同,能确保执行规则。具备行为准则、对话流程等功能模块,适用于金融、医疗等场景,已在金融场景落地。
别求Claude了!搭子DuMate杀疯,国产Cowork已帮你把活干完了
Anthropic更新Claude帮助中心,对部分用户启用身份验证,让国内重度用户焦虑。百度智能云上线搭子DuMate,它是桌面级AI智能体,能自动化办公,还更懂国内工作场景,上线后高频迭代。