「国科大」共找到 5050 篇相关文章
从顶级三甲到医疗巨头,他们为何都选择同一个AI“大脑”?
AI医疗迎来爆发,政策、技术、需求共振催生千亿蓝海。智诊科技WiseDiag医学多模态大模型成医疗企业破局关键,它有三大核心能力,适配多场景,还有低风险接入方案,现开放API免费试用。
阿里云CIO首次系统复盘:大模型落地的 RIDE 方法论与 RaaS 实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,指出企业中业务与 IT 对 AI 认知矛盾突出。他展示阿里云数字人落地成果,提出 RIDE 方法论,还剖析翻译和 Agent 两种应用模式及落地要点。
AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」
Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。
单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地
3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级大模型,还推出“大模型+小模型”协同架构释放企业算力价值。
Claude Code、Cursor 可能都躲不过一次“大重写”,但 OpenCode 也许是例外
文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“大规模重写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。
前OpenAI灵魂人物Jason Wei最新演讲!三大思路揭示2025年AI终极走向
前OpenAI核心研究员Jason Wei在斯坦福演讲,提出AI发展三大思路。他认为智能会商品化、成本下降,自适应算力出现;所有能被验证的任务最终会被AI解决;AI智能呈锯齿状,不会瞬间超越人类。
攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0
9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。
DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍
扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。
训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家
动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。
检索做大,生成做轻:CMU团队系统评测RAG的语料与模型权衡
CMU团队在最新ECIR接收论文中,系统评估RAG语料规模与生成模型规模替代关系。实验表明,语料扩容可让小模型追上大模型,提升主要来自证据覆盖。研究为RAG系统提供更具性价比提升路径。