信息过滤」共找到 694 篇相关文章

开源动态7

DeepSeek新模型DeepSeek-V4-Lite-285B测试曝光:“大海捞针”召回率100%

社区消息显示DeepSeek正测试新模型DeepSeek - V4 - Lite - 285B,用OpenAI MRCR 8 - pin标准考察超长上下文信息检索能力。测试结果优异,但‘大海捞针’法或被DSA作弊,实际效果存疑,社区高度关注其进展。

AI工程化
算法论文7

VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。

机器之心
产品应用8

全球第二、国内第一!钉钉发布DeepResearch多智能体框架,已在真实企业部署

在数字经济浪潮中,企业对高效信息获取与决策支持需求迫切,但现有研究系统存在不足。阿里巴巴钉钉团队提出Dingtalk - DeepResearch多智能体框架,在评测中成绩优异,已在真实企业场景部署。

机器之心
算法论文8

一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军

加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。

新智元
推荐文章7

超越 Prompt 和 RAG,「上下文工程」成了 Agent 核心胜负手

本文称「上下文工程」成 Agent 核心胜负手,它指在正确时间为 Agent 提供正确信息,超越 Prompt 和 RAG。文章归纳五大策略,如转移、压缩等,并结合 *The Bitter Lesson* 启示,探讨构建面向未来的 AI Agent。

海外独角兽
开源动态8

快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!

快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。

AI前线
推荐文章8

迈向可信AI:LLM幻觉的分析与优化

随着LLM广泛应用,其幻觉现象成AI落地关键挑战。文章分析LLM幻觉成因、优缺点,结合RAG、SFT、强化学习等技术,提出多维度优化方案,为构建可信大模型应用提供理论与实践路径。

腾讯技术工程
新闻资讯7

「回答一切」吐槽潮中 Sam Altman 确认: 4o 回归,GPT-5 将进行六大改进

OpenAI在Reddit举行GPT - 5问答活动,网友吐槽多。Sam Altman确认GPT - 4o回归,还表示GPT - 5将进行加倍调用速率、保留旧模型选择权等六大改进,同时回应了用户对旧模型、调用限额等方面的质疑。

AI寒武纪
开源动态8

JinaVDR: 一个图文混排文档搜索任务的基准集

现有文档检索基准大多只考虑纯文本,难以处理含图表等视觉信息的文档。JinaVDR 应运而生,它是图文混排文档搜索基准集,含多语言、多领域数据,可评估模型在复杂视觉文档的检索性能。

Jina AI
新闻资讯7

The Batch: 852 | 加州重新制定人工智能监管框架

加州人工智能前沿模型联合政策工作组发布《加州前沿人工智能政策报告》,为立法者提供监管尖端AI模型的政策原则。报告聚焦前沿模型监管,提出综合多源证据、鼓励信息披露等结论,还探讨了美国AI监管现状。

DeeplearningAI