探索增强框架」共找到 2572 篇相关文章

开源动态8

Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序

2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。

通义千问Qwen
新闻资讯7

大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约

本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。

深度学习自然语言处理
新闻资讯7

微软发布了 TypeScript 5.9,延迟导入并增强了开发者体验

微软发布 TypeScript 5.9,带来开发者体验改进、新特性和性能优化,如支持延迟导入、改进默认项目设置、引入新模块选项等,也有性能升级,还透露未来版本计划。

InfoQ
新闻资讯7

高通将以24亿美元收购Alphawave Semi,增强AI数据中心份额

高通官网宣布以24亿美元收购Alphawave Semi全部已发行及待发行普通股票,旨在加速其数据中心领域扩张。Alphawave技术能实现高速数据传输,与高通处理器互补,双方将携手推动AI计算等领域发展。

AIGC开放社区
产品应用7

视觉AI从「会生成」走向「能创作」,RabbitVis探索AI应用新范式

随着AI生图能力提升,如何让AI进入创作流程成新问题。兔展智能基于UniWorld - Design视觉AI大模型推出RabbitVis,推动视觉AI从图片生成走向可编辑、可交付的创作流程,解决创作流程断点问题。

机器之心
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
推荐文章8

从实践到原则:为 AI Agent 构建的 Harness Engineering 落地与探索

生成式 AI 进入软件开发核心流程,但 AI 写代码速度超团队控复杂度能力。问题不在模型,而在软件工程系统。Harness Engineering 试图解决此问题,从三层面重新设计工程系统,已有公司实践。

phodal
产品应用8

字节跳动:Apache Doris + AI 一站式融合数据引擎的探索与实践

本文整理自字节跳动 DataMind 负责人演讲,介绍了基于 Apache Doris 打造的一站式引擎 DataMind。它集成 Hybrid Search、AI Function、GraphRAG 等能力,部分成果已贡献开源,还给出企业级 AI 问数落地方案。

InfoQ
算法论文7

知识增强LLM与搜索引擎用户的感知信息价值差异比较研究

研究选取文心一言与百度搜索引擎,探究不同任务复杂性、信息获取场景下,用户使用两种工具后的感知信息价值差异。发现两者在部分指标有显著差异,还给出两类工具优化建议。

PaperAgent
开源动态7

多模态RAG哪家强?9 个 Embedding、4 类 MLLMs、4 大框架实景比拼

现有文档 RAG 评测存在不足,华南理工和华科推出 DOUBLE - BENCH 进行多模态 RAG 实战评测,结果显示检索是瓶颈,模型爱胡说。快手开源 Keye - VL - 1.5 - 8B,PaperAgent 有实操指南。

PaperAgent