「架构规范」共找到 1951 篇相关文章
南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B
南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。
2499 元产品背后:地瓜机器人将智驾 know-how 转为机器人新解法
AI重塑机器人技术边界,具身智能成新战场。地瓜机器人从地平线拆分,将智驾经验用于机器人。它提出大小脑分层架构落地更快,还推出RDK S100套件,搭建具身智能底座应对数据和应用难题。
独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 大模型与本体
AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA大模型技术,推进自研机器人本体工程化与量产。其VLOA大模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。
Google开源DESIGN.md。玩AI,今年最该知道的Markdown!
Google开源DESIGN.md格式规范,对用AI coding的人很实用,可约束产品UI设计。开源社区已有70+大厂的DESIGN.md及自动提取的开源项目。还有汇聚大厂设计规范的仓库及可自动生成的工具,或成行业标准。
GLM-5正式发布,744B参数,对标Claude
GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。
华人学生立大功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍
新一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用新设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。
为什么 Agent Memory需要 AML:看 AML “变量控制”的工程设计
传统 Agent 记忆评测有水分,近日放榜的 Agent Memory Leaderboard (AML) 通过严格控制变量构建盲测管线。文章从技术架构深拆其工程细节,还分析了首期榜单,指出其重构评估变量的价值。
红杉对话 LangChain 创始人:2026 年 AI 告别对话框,步入 Long-Horizon Agents 元年
红杉访谈 LangChain 创始人 Harrison Chase,探讨 Long-Horizon Agents。其认为 2026 年是 Doers 元年,这类 Agent 能处理长时程任务。还提及 Harness 架构、Coding Agent 等,指出 Memory 是壁垒,交互需同步与异步结合。
我们测试了百度的「AI 科学家」,它正在悄悄淘汰算法工程师
百度 2025 世界大会亮相的「伐谋」,是全球领先可商用自我演化超级智能体。它源于进化论,能让算法自我进化。实测显示其在生活场景和复杂决策问题上表现优越,架构精巧,将推动算法研发普惠化。
谢赛宁盛赞字节Seed新研究!单Transformer搞定任意视图3D重建
字节Seed康炳易团队的最新研究成果Depth Anything 3(DA3),获谢赛宁盛赞。它架构简单,能从多种输入中精准算出物体深度、还原相机位置,在新视觉几何基准上表现出色,核心秘诀是极简设计。