「任务特化训练」共找到 3641 篇相关文章
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
Claude Code 新增 /btw 功能:让你在 AI 干活时「插嘴」提问
Anthropic工程师Thariq宣布Claude Code新增`/btw`命令,支持在其执行任务时开启「旁路对话」。该功能不打断任务、不污染主对话历史,能解决提问痛点,反映AI编码工具走向「持续协作」趋势。
99%的人只发挥出了龙虾的1%的能力:龙虾邪修养法
博主Alex Finn分享让OpenClaw效能提升100倍的核心方法论,即构建专属任务控制中心。介绍了任务看板、日历面板等核心工具模块,还指出不要盲目抄袭,要用反向提示词定制工具面板。
现实魔幻!我在AI跑腿网站标价350,和2万碳基同胞一起排队抢单
AI开始雇佣人类跑腿,rentahuman.ai这个赛博“用工市场”上线不到48小时,AI储备的人类劳动力就破万,AI发任务和报酬,人类注册接单,任务内容多样,有网友已收到报酬。
CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源
中国人民大学、清华和腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。
从0到1带你速通 Marvis马维斯
AI 时代,Agent 产品虽强但普通用户使用门槛高。本文详细介绍腾讯 Marvis,它能让 AI 直接理解电脑,可执行多项任务。作者实测 6 个任务展示其功能,认为它是面向普通用户的系统级 AI 管家。
只用国产GPU训练的大模型性能飙升100%!国内唯一,更懂你
科大讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音大模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。
AI集体“听不懂”!MMAR基准测试揭示音频大模型巨大短板
MMAR基准测试对30款音频相关模型进行测试,结果显示,多数开源模型面对复杂音频推理任务远未达实用水平,音乐任务中所有模型表现不佳,且有显式推理能力的模型表现更优。
训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家
动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。
Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude
Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为大模型要规模化,断言大模型训练进入第三阶段。