「深度学习编译器」共找到 2002 篇相关文章
Jina Code Embeddings: 为高质量代码搜索而生的0.5B/1.5B向量模型
本文介绍了 Jina AI 开源的代码向量模型 `jina-code-embeddings`,含 0.5B 和 1.5B 规模,有 GGUF 量化版本。它性能顶尖,支持多任务与 15 种语言,还介绍了训练方案、使用方法等。
Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品
尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。
AI Agent做PPT卷疯了,最强选手被挖掘出来了
2025年是AI Agent元年,做PPT成成果显著领域。Agent能自主完成PPT全流程,解决此前导出编辑难题。文章对比GenSpark、天工Agent等产品在不同场景做PPT的表现,为用户选择提供参考。
基于MCP协议的12306购票搜索服务器项目解析(附配置流程)!
文章介绍基于MCP协议的12306购票搜索服务器项目12306 - mcp,涵盖功能特点、技术架构、服务原理、数据流程、工具及安装配置,还给出GitHub地址,助开发者提升购票查询体验。
一周两破18年数学纪录!陶哲轩惊叹:AlphaEvolve带来久违「加速度」
人类数学家与AlphaEvolve携手,一周内两次刷新18年未破的数学纪录。先是AlphaEvolve将和差集的θ下界提升,后人类数学家Gerbicz在其基础上再进一步,展现AI与人类协作在数学研究中的惊人潜力。
“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户
围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。
软件 3.0 时代来临
OpenAI 联合创始人 Karpathy 在 AI Ascent 2026 大会提出软件正经历第三次范式转移。从 Software 1.0 到 3.0,人类参与编程方式不断变化,3.0 用自然语言编程,中间层应用被模型原生能力吞噬。
最新!万字综述Harness革命!
作者分享Harness Engineering直播笔记,介绍Harness解决Agent落地卡点,其公式为Agent = Model + Harness,有六大核心组件,还梳理了主线,指出Harness是驾驭Agent不确定性的关键,且工程师不会失业。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
全球开源 AI 生态的未来:从 DeepSeek 到 AI+
这是关于中国开源社区自2025年1月‘DeepSeek时刻’以来进展的系列博客最后一篇,介绍中国AI企业和机构发展路径,展望开源未来方向,指出全方位开放共享成关键路径,‘有机生态’正成型。