「医学推理数据」共找到 4218 篇相关文章
抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅
视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在多类任务中显著提升性能,实现范式跃迁。
打破幻觉!Qwen最新OCR让印章、表格、公式识别准确率飙升45%
基于推理增强框架的视觉语言模型处理OCR任务有成果,但存在生成幻觉问题,特定领域不如专家模型。DianJin - OCR - R1通过推理与工具交互,按‘思考 - 调用工具 - 重新思考’流程提升OCR性能,减少幻觉。
干掉 90% 的 BI 工程师:自动生成 SQL、洞察、预测,连图表都帮你画好
介绍了基于LLM和RAG的结构化数据问答系统,它能将查询转化为SQL语句执行,生成数据图表及分析。其看板用法新颖,可进一步分析、预测,免去大部分BI工作,对非技术分析人员友好。
首发丨美团悄咪咪公测 AI 袋鼠参谋 App
美团正在公测AI袋鼠参谋App,它是基于AI大模型决策能力的智能应用,依托海量门店信息和多年运营经验,覆盖4类经营场景,以“数据向决策的翻译服务”帮商家解决开店难题。
智源:ArXiv CLI重磅开源!2亿+开放论文,即将化身科研智能体的技能包
智源研究院联合高校与社区开发者研发的 DeepXiv 开源并免费开放。它是面向智能体的科技文献综合性工具集,提供数据接入、一站式能力集成、丰富接入形式等核心能力,还通过实战演示展示其在科研任务中的价值。
机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes
文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。
对抗协作+原型学习!深北莫FedPall开源,联邦学习破局特征漂移,准确率登顶SOTA
深圳北理莫斯科大学人工智能研究院在ICCV发表FedPall算法,结合原型对比与对抗协作学习,在多种特征偏移数据集获SOTA性能。该算法通过多步骤训练缓解特征漂移,在多个公开数据集表现出色。
复读一年,AI 把高考数学成绩从及格线提到 145 分!AI 数学能力发生了什么?
今年媒体让AI做高考数学题,Gemini 2.5 Pro获145分排第一。从去年到今年,AI数学能力指数级增长,这得益于推理模型。推理模型用思维链和强化学习解题,未来高考数学或难区分模型能力。
突发!OpenAI推出首款自研AI芯片:能效暴打当前SOTA,今年底G瓦级部署
OpenAI和博通联合发布自研AI推理芯片Jalapeño,它专为大模型推理设计,每瓦性能优于当前最先进水平,九个月完成设计制造,是全栈战略一部分,2026年底开始吉瓦级部署。
变更即指标:用交付信号度量系统可靠性
系统变更是生产事故主因,本文提出聚焦变更可观测性的指标框架,介绍可扩展架构采集展示指标。定义业务和技术指标,构建以事件为中心架构获取数据,还阐述以数据驱动改进变更交付过程。