医学大模型」共找到 9157 篇相关文章

算法论文8

CoT推理溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四模式,并提出四种缓解策略。

新智元
开源动态7

突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent

Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有招。

AI寒武纪
产品应用7

Unsloth让模型跑在手机上!

Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰机上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。

AI工程化
开源动态8

刚刚,最佳VLA模型GigaBrain-0开源:世界模型驱动10倍数据,真机碾压SOTA

近日,极佳视界与湖北人形机器人创新中心联合发布端到端VLA具身基础模型GigaBrain - 0,这是国内首个用世界模型生成数据实现真机泛化的模型,后续将全面开源,能完成复杂操作,实验成功率超SOTA方法。

新智元
推荐文章7

蚂蚁武威:下一代「推理」模型范式猜想

文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。

AI科技评论
新闻资讯8

神秘模型屠榜多日、碾压Seedance 2.0!背后竟是阿里招:新部门首作实锤,引爆股价拉升

近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。阿里巴巴确认其为 ATH-AI 创新事业部自研产品,正在内测,4 月 30 日上线 API。该模型技术亮点多,若开源或改变 AI 视频行业格局。

InfoQ
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
新闻资讯7

苹果拆解AI脑,推理模型全是「装」的?Bengio兄弟合著

苹果最新研究揭示推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。

新智元
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试模型智能体管理业务能力。实验显示不同模型性能方差,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动

新智元
开源动态8

杨植麟被梁文锋叫醒了!Kimi新模型发布即开源,1T参数全线SOTA

172天后,Kimi推出全新Kimi K2基础模型回应DeepSeek冲击。它为MoE架构,1T参数,激活参数32B,在多任务上领先,发布即开源,还分享技术细节,实测有亮点也待优化,展现回归之势。

量子位