「信息识别」共找到 889 篇相关文章
滴滴给我发了个赛博助理,专管出行的那种
滴滴上线的Agent小滴,让打车更智能个性。用户只需一句话,就能提出多样需求,小滴还能识别模糊需求。它激活了滴滴运营积累,体现行业新趋势,成了用户的赛博出行助理。
ICLR 2026还会好吗?300篇投稿50篇含幻觉,引用example.com竟也能过审
GPTZero扫描300篇ICLR 2026投稿论文,发现50篇含引用幻觉,如用example.com作引用,且经同行评审也未识别。学术会议和期刊在AI重压下不堪重负,GPTZero幻觉检测工具或助同行评审。
让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了
NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。
全球第二、国内第一!钉钉发布DeepResearch多智能体框架,已在真实企业部署
在数字经济浪潮中,企业对高效信息获取与决策支持需求迫切,但现有研究系统存在不足。阿里巴巴钉钉团队提出Dingtalk - DeepResearch多智能体框架,在评测中成绩优异,已在真实企业场景部署。
一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军
加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。
EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力
论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。
0.07B大败QwenVL72B!百度开源OCR3.0"三件套"
OCR 历经四次范式迁移,工业落地存在精度与参数量等矛盾。百度开源 PaddleOCR 3.0“三件套”,含 PP - OCRv5、PP - StructureV3、PP - ChatOCRv4,各有创新点,解决了多语种识别、版面还原等问题。
超越 Prompt 和 RAG,「上下文工程」成了 Agent 核心胜负手
本文称「上下文工程」成 Agent 核心胜负手,它指在正确时间为 Agent 提供正确信息,超越 Prompt 和 RAG。文章归纳五大策略,如转移、压缩等,并结合 *The Bitter Lesson* 启示,探讨构建面向未来的 AI Agent。
迈向可信AI:LLM幻觉的分析与优化
随着LLM广泛应用,其幻觉现象成AI落地关键挑战。文章分析LLM幻觉成因、优缺点,结合RAG、SFT、强化学习等技术,提出多维度优化方案,为构建可信大模型应用提供理论与实践路径。
JinaVDR: 一个图文混排文档搜索任务的基准集
现有文档检索基准大多只考虑纯文本,难以处理含图表等视觉信息的文档。JinaVDR 应运而生,它是图文混排文档搜索基准集,含多语言、多领域数据,可评估模型在复杂视觉文档的检索性能。