「医学推理数据」共找到 4218 篇相关文章
一场文心大模型的「AI马拉松」
2025 年模型能力至关重要,百度在基础模型研发持续投入。百度 AI Day 上,吴甜解读文心新模型技术,文心 X1 Turbo 推理强、成本低。百度技术体系完备,未来看好多模态与智能体,降成本促应用生态发展。
开源模型TOP5,被中国厂商包圆了
10月公开数据显示中国开源大模型占据榜单前五,阿里Qwen系列和DeepSeek影响力深远。从LMArena榜单、HuggingFace数据看,国产模型表现佳。还提及Llama 5相关传闻。
刚刚,全球首个加密AI产品完成保险签约!你敢用,它敢赔
7月7日,荆华密算与人保北京市分公司、AI原点社区签下全球首单AI企业数据损害赔偿责任保险。荆华密算构建“双重信任闭环”,一手技术自证,一手保险兜底,其产品“墨镜熊”正在内测。
情人节暴击!下跪求婚的可以是机器人了
情人节,Unitree G1 人形机器人解锁求婚技能。背后是清华叉院等联合团队的 HuMI 框架,解决人形机器人数据采集难、效率低问题,通过硬件、交互与算法协同,实现低成本、高效全身操作策略学习。
微软 Agentic 组织:下一代 AI 系统
微软研究院提出全新推理范式AsyncThink,让LLM从单打独斗进化成带团队的项目经理。它把并发控制转为纯文本协议,经两阶段训练,实验中全方位碾压传统方法,还具跨领域泛化能力。
刚刚,全球首个超高帧世界模型诞生!英伟达含量0,狂飙50帧
魔芯科技联合浙大潘云鹤院士团队发布全球首个Flash World Model——MoWorld,全栈基于国产NPU,实现50FPS实时推理,推理成本降70%,为世界模型产业化带来新思路。
OpenAI发布权威AI科研基准,扯下AI遮羞布:奥赛金牌≠一流科学家!
OpenAI在2025年12月16日发布FrontierScience基准,用超700道题从物理、化学、生物维度考验AI科研推理能力。评测分竞赛和研究赛道,初测显示GPT - 5.2领先,但前沿模型仍有诸多问题。
AI翻译的「最后一公里」
文章指出文化差异成AI翻译难题,通用大模型数据不平衡,存在“算法霸权”。如处理低资源语言,AI易产生幻觉,还因无肉身难理解基于生理体验的隐喻,人机协作才是翻译未来。
数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1能力再升级 | 通专融合新进展
2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。
ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」
文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。