「外部验证」共找到 945 篇相关文章
阿里搞了个全能解析器,文档、图片、音频、视频一锅端
阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。
AI的记忆问题解决了!最强记忆基准99%的准确率
Supermemory团队构建的实验性AI智能体流程,在LongMemEval基准测试中达近99%准确率。其技术摆脱传统限制,以新方式处理信息。ASMR创新数据摄取和检索管道,有两种回答流程,团队计划开源代码。
Token,应该翻译成「新智元」
作者经信息论分析、构词法验证等,提议将Token中文标准译名定为「新智元」。现有译名如「托肯」「令牌」等都不满足要求,「新智元」能覆盖技术和经济属性,符合翻译学标准。
最强开源搜索再升级,研究、预测能力实测超惊艳!
MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。
Communications Engineering | 西湖大学&女王大学:面向阵风气动建模的表面压力时空动力学关联研究
西湖大学联合女王大学团队提出 Graph Transformer 框架用于阵风气动建模,融合图神经网络与注意力机制,从表面压力信号学时空关联,实现气动力准确预测,为AI在复杂气动建模提供新思路。
OpenClaw只养一只龙虾?难怪不好用。我直接养了6只,效果炸裂!
文章指出OpenClaw默认配置养虾易出问题,介绍了一次养多只虾的方法,包括建虾、注入人格、写通讯录、接入飞书、改配置文件、重启验证等步骤,还提及进阶玩法。
2026 年,万物皆 Coding Agent 的平台工程新范式(A2A / ACP / MCP / Skill)
过去 DevOps 工具链复杂,如今 AI 重塑其为 Coding Agent。借助 A2A、ACP、MCP 和 Skill,可构建 Agent 网络。文章分析平台工程演进,介绍相关协议,对比编排模式,还给出 Routa 编排架构实践参考。
速度提升,能力却暴跌?扩散模型做智能体的残酷真相
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
Swift 跨平台框架 Skip 现已完全开源
Skip 是用 Swift/SwiftUI 代码库创建 iOS 和 Android 应用的方案,经三年开发后团队将其完全开源,此前为付费方案。开源既是因开发者希望免费获工具,也为保证工具持久性,它能实现原生体验。
四问智谱上市|甲子光年
2026年1月8日,智谱AI在港交所上市。本文围绕其上市提出四问:是否为“中国OpenAI”、投资人押注点、商业模式健康度及“钱路”方向。指出它应卸下标签,回归技术与商业本质。