搜索能力」共找到 3549 篇相关文章

算法论文8

0%通过率!Code神话泡沫!LiveCodeBench Pro发布!

国际算法奥赛金牌得主团队测试20个顶级大模型,在584道编程赛题上,高难度题目AI通过率为0%。论文发布LiveCodeBench Pro评测方法,揭示AI编程能力神话泡沫,指出其问题并给出提升方向。

深度学习自然语言处理
算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
新闻资讯8

大模型进入研发体系后,我们看到了这些变化

InfoQ《极客有约》X AICon 直播邀请同程、网易、百度工程师,探讨大模型入研发体系的变化。涉及提效、协作、角色分工等方面,还谈及工程师特质、效率焦虑、岗位数量等问题,6 月北京 AICon 大会将深入交流。

InfoQ
产品应用8

揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
算法论文8

医学领域也有世界模型了:精准模拟肿瘤演化,还能规划治疗方案

来自多机构学者联合提出医学世界模型(MeWM),赋予AI“预演”疾病发展的能力。它能模拟肿瘤演化,为个性化治疗提供辅助,有肿瘤演变模拟、生存风险预知和临床决策闭环三大核心功能。

量子位
开源动态8

揭秘开源Agentic‑Doc真能支撑120 W+ 查询?医疗/金融/法务都在用,确实是有这么 6~~~

LandingAI的Agentic Document Extraction是领先OCR且具视觉结构化能力的Python SDK,可处理复杂文档。它功能丰富,架构合理,支持多格式输出。在多行业有应用,性能提升显著,与同类项目相比优势明显。

小华同学ai
新闻资讯7

一文读懂:国产AI芯片与英伟达的差距有多大?

文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。

芯师爷
开源动态8

上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下

上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能力。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。

量子位
开源动态8

突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!

在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。

开源星探
新闻资讯8

终于来了!ChatGPT更新:新增录音功能,深度研究也可以访问文档和应用程序了

OpenAI对ChatGPT进行更新,在深度研究功能中增加连接器,可连接企业和个人数据源,进行更深入搜索分析;新增录音模式,支持自动整理重点内容等。还调整定价策略,让现有部分用户能访问新功能。

AI寒武纪