「大数据任务」共找到 7795 篇相关文章
SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门
现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。
全球最大AI榜单塌房!52%高分答案全是胡扯,硅谷大厂集体造假?
2025年底,《LMArena is a cancer on AI》一文引发关注,其指出LMArena这个权威大模型评测平台问题严重。Surge AI调查发现,52%获胜回答事实错误,39%投票结果与事实相悖,Meta还曾为榜单优化模型。
120页深度报告,搞懂今年大模型和应用的现状与未来
Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且迭代快,应用渗透各行业,智能体崛起,市场结构变革,公司运作方式也在重塑。
从顶级三甲到医疗巨头,他们为何都选择同一个AI“大脑”?
AI医疗迎来爆发,政策、技术、需求共振催生千亿蓝海。智诊科技WiseDiag医学多模态大模型成医疗企业破局关键,它有三大核心能力,适配多场景,还有低风险接入方案,现开放API免费试用。
阿里云CIO首次系统复盘:大模型落地的 RIDE 方法论与 RaaS 实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,指出企业中业务与 IT 对 AI 认知矛盾突出。他展示阿里云数字人落地成果,提出 RIDE 方法论,还剖析翻译和 Agent 两种应用模式及落地要点。
AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」
Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。
单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地
3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级大模型,还推出“大模型+小模型”协同架构释放企业算力价值。
千问APP迈出重要一步:打通阿里生态业务,这可能是AI应用最坚固的护城河。
Google宣布Gemini联手沃尔玛让AI帮用户购物支付,被指是AI Agent落地时刻。而千问APP悄悄上线任务助理功能,打通阿里生态业务,调用淘宝、高德等MCP,能执行复杂任务,生态或是Agent终极壁垒。
Claude Code、Cursor 可能都躲不过一次“大重写”,但 OpenCode 也许是例外
文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“大规模重写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。
攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0
9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。