「模型可解释性」共找到 10003 篇相关文章
1B 参数跑出 2B 性能?面壁 MiniCPM5-1B 用 AI 自进化,提速 AGI 进程
全球AI行业陷入资源消耗战,面壁智能绕开物理瓶颈,提出“AI制造AI”路径。2026年5月25日发布MiniCPM5-1B,有越级性能、极致压缩比和均衡能力,源于“模型、框架、数据”自进化范式。
直播预约 | Evaluation论文分享@ICML&ACL2025
2025年6月11日20:00将直播分享Evaluation论文。多位嘉宾参与,涉及SyncPL奖励建模、文本事实一致性验证、大模型评测方法等多领域论文,涵盖模型优化、基准测试等内容。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
突发:微软转向使用 Anthropic 以减少对 OpenAI 的依赖
据 The Information 报道,微软将为 Office 365 Copilot 引入 Anthropic 技术,减少对 OpenAI 依赖。因 Anthropic 模型性能更好,微软还将通过 AWS 付费访问其模型,此前 GitHub Copilot 已引入该技术。
个体如何实现主权AI
文章指出越依赖AI,越要考虑‘主权AI’问题。对个体而言,实现主权AI核心是掌握自身数据等,能随时换底层模型,还介绍积累的四类资产、微调顺序及现实路径。
这款OCR神器绝了,PDF、表格、手写体通吃,20+文档支持,9.4K Star!
开源君在Github发现开源OCR工具Zerox,由Omni - AI团队开发,利用AI视觉模型“阅读”文档,将多种格式文档转Markdown。它功能强大,处理复杂文档优势明显,在Github获9.4K Star。
深谋科技独家发布真正为人类服务的新一代人形机器人核心技术「声波传感 · 意念控制 · 高精视觉 · 类脑智能」
2025世界人工智能大会7月将举行,深谋科技作为精英合作伙伴参展。其秉持服务人类理念,携系列核心技术亮相。有独创传感系统、脑机交互方案等,还将推通用具身智能世界模型。
Cloudflare推出Markdown for Agents:AI抓取网页的方式彻底变了
Cloudflare推出Markdown for Agents功能,允许网站在服务器端将HTML实时转为Markdown。传统AI处理网页内容耗资源、费token,此功能可节省80%。开发者可升级抓取逻辑,还有实用工具markdown.new。
测试时也能RL,英伟达等提出全新范式:TTT-Discover
近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。
Token消耗暴降80%,Cloudflare让服务器原生支持Markdown:OpenClaw要笑醒了
Cloudflare发布Markdown for Agents功能,让Web服务器可向AI Agent投喂Markdown数据,抛弃臃肿HTML,Token消耗降80%,还引入内容信号机制,有手动挡工具,功能处Beta阶段,可免费启用。