训练方法」共找到 3281 篇相关文章

算法论文8

AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」

Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
推荐文章8

重磅!全都看过来,Anthropic官方发布万字Skill创建完全指南:保姆级终极攻略

Anthropic官方发布万字Claude技能创建指南,涵盖规划、设计、测试和分发等知识,介绍技能结构、设计原则,提供不同用例模式及故障排查方法,适用于开发者、高级用户和团队。

AI寒武纪
开源动态7

智能旅行助手

开发者开源智能旅行助手 AI Travel Agent Streamlit,集成 OpenAI、天气 API 等服务,可在直观界面完成旅行规划。介绍了设置、运行、部署方法,还提及测试、安全等要点。

GitHubStore
新闻资讯7

The Batch: 906 | AI 巨头分担维基百科的成本

维基百科成立25周年,维基媒体基金会与Amazon、Meta等多家AI公司达成合作,推出Wikimedia Enterprise计划,允许合作方高速大规模访问数据。维基百科需资金支持,AI公司也需其数据训练模型。

DeeplearningAI
产品应用7

自动化评测的九九归一——评测agent

本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。

阿里云开发者
开源动态8

蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王

蚂蚁开源团队推出 Ring-1T 模型,它结合强化学习与多阶段推理机制,实现从‘模仿’到‘思考’的转变。该模型在多基准测试表现优异,其高性能得益于 IcePop、C3PO++、ASystem 三项关键技术。

AI科技评论
新闻资讯7

你天天用的Claude和Codex,Meta内部不让随便用了

今年5月Meta给工程师划红线,限制用Claude Code和Codex,因其太好用。Meta组建团队自研编程助手MetaCode,担心外部模型输出渗进训练数据,出现“蒸馏陷阱”,且能省钱。

新智元
算法论文8

OpenClaw带火AI记忆,DeepMind用混合记忆把3D重建拉到近2万帧

近期,全球爆火的 Agent 私人助手 OpenClaw 接连更新,其长期记忆能力获关注。谷歌 DeepMind 联合加州大学伯克利分校提出 LoGeR 架构,将 3D 重建扩展到极长序列,在多数据集上表现超越先前方法

机器之心
开源动态8

LLM长文本内卷,谁是真英雄?告别跑分玄学,我们需要一把“公道秤”

OpenNLG Group做了统一长上下文评估框架LOOM - Scope,兼容主流benchmark、model和长上下文加速方法。该框架围绕BENCHMARK、DEPLOYMENT和EVALUATOR三大核心模块,还提出LOOM - Bench应对评估成本制约。

深度学习自然语言处理