检索脆弱性」共找到 769 篇相关文章

推荐文章8

大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲

Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。

机器之心
推荐文章8

解读|生产级RAG系统落地的10个经验教训

本文解读Douwe Kiela分享的企业级RAG系统实施十大经验,如要有系统思维、专业化优先等,还推荐新作《MCP原理揭秘与开发指南——构建可扩展的AI智能体》。

AI大模型应用实践
产品应用7

Jina Embeddings v4 的量化感知训练

文章聚焦Jina Embeddings v4的量化感知训练。介绍量化技术可压缩向量体积、提升检索效率,对比四种主流量化方法,重点实验PTQ和Output QAT,还测试非对称量化,给出实验结果与结论。

Jina AI
开源动态8

开源Agent新标杆:通义WebSailor多榜夺魁,挑战OpenAI高难度Agent基准BrowseComp

信息爆炸时代,传统搜索引擎难满足需求,开源Web Agent在极端复杂任务表现不佳。阿里巴巴通义实验室推出WebSailor,通过创新数据构造和训练方法,在BrowseComp等挑战上取得突破,缩小与顶级封闭系统差距。

机器之心
开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。

量子位
开源动态8

会“思考”的目标检测模型来了!IDEA提出Rex-Thinker:基于思维链的指代物体检测模型,准确率+可解释双突破

现有目标检测方法有决策不透明和拒识能力不足问题。IDEA提出Rex - Thinker,引入“逻辑推理链”,构建可解释推理框架,经两阶段训练,在测评中准确率提升,可解释强,有良好泛化能力。

机器之心
算法论文8

3D VLA新范式!CVPR冠军方案BridgeVLA,真机能提升32%

中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机能提升32%。

新智元
新闻资讯7

如果海外EDA断供,国产EDA公司能支棱起来吗

文章分析了EDA行业及国产EDA覆盖情况。全球三大家EDA公司处于垄断地位,EDA市场规模小,容纳公司有限。国产EDA公司数量多但有差距,部分工具可用但仍需打磨,国产EDA发展道路艰难但要坚持。

芯师爷
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
开源动态8

RF-DETR-首个突破60 AP的实时检测器(附实战教程)

RF-DETR在COCO数据集上,实时检测精度首破60 mAP,兼顾实时与高精度。它通过NAS找到Transformer实时运行的‘最优解’,迭代快,适用于多场景,还给出完整实战教程。

机器学习AI算法工程