「绝对零训练法」共找到 2427 篇相关文章
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师
以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型从互联网视频学三维空间音频感知,成果入选会议Highlight。
取消AI考核、零裁员!股价暴跌82%后,多邻国走出了一条反硅谷之路
多邻国曾是AI转型标杆,后股价暴跌82%。其联合创始人兼CEO Luis von Ahn在访谈中称未裁员,还分享公司用AI情况,如取消AI考核、员工用AI做课程等,也谈到了AI局限和各职业前景。
取消AI考核、零裁员!股价暴跌82%后,多邻国走出了一条反硅谷之路
多邻国曾是 AI 转型标杆,股价一度暴涨,但近一年暴跌 80%。创始人 Luis von Ahn 表示不裁员,曾将 AI 应用纳入考核又取消,分享员工用 AI 开发课程案例,还谈了 AI 局限、对行业影响及公司应对策略。
深度机智和他们的另一条路:用人类第一视角数据训练基座模型|甲子光年
3月27日,深度机智联合推出具身通用智能基座模型系统PhysBrain 1.0,引入人类第一视角数据,解决传统模型问题。其创始人陈凯等坚持用此数据构建模型,突破传统,引领行业新方向,且中国在具身智能领域或借此建立自主技术体系。
腾讯「鹅虾」紧急上线!一手实测:养虾门槛归零,QQ飞书钉钉全能接
腾讯昨日上线两个「鹅虾」产品,WorkBuddy是能接入多平台的智能体桌面平台,QClaw预计下周公测,可接入微信。作者实测WorkBuddy,考察其生态接入、代码开发等场景表现,还介绍了QClaw特点及腾讯云轻量应用服务器。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
腾讯把IMA知识库开源了!WeKnora支持Agent调用、MCP协议扩展,企业级RAG零成本落地
腾讯开源WeKnora,这是面向复杂异构文档的LLM框架,走完整RAG流程。它有Agent模式,支持多种知识库类型和格式,有Web UI。适合公司、研究者、开发者等,还给出了上手步骤和部署提醒。
合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型
为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。
推荐大模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本
随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。
一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交大&上海AI Lab等
上海交大和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。