数字人算法」共找到 1857 篇相关文章

算法论文8

用中等难度prompt做高效post training

近年来,RL后训练在LLM发展中至关重要,但传统方法效率低。本文提出PCL轻量级算法,通过动态选中等难度提示提升LLM后训练效率,经多基准实验验证其优越性,也指出方法局限与未来方向。

深度学习自然语言处理
推荐文章7

分享一个我用了2年的深度研究Prompt,半小时帮你搞懂任何陌生领域。

作者分享用了2年的深度研究Prompt,即横纵分析法。该方法结合社会科学和语言学经典视角与商业分析思路,有Prompt和Skill版本且已开源。虽有局限,但能半小时帮建立认知框架,助其快速入门陌生领域。

数字生命卡兹克
开源动态7

Unsloth宣布更新,可免费用强化学习训练视觉大模型Qwen2.5-VL-7B

Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。

AI工程化
产品应用8

MoE推理「王炸」组合:昇腾×盘古让推理性能狂飙6-8倍

在通往AGI进程中,MoE模型成大模型推理提效关键。华为推出Pangu Pro MoE 72B模型,经多方面优化,推理性能提升6 - 8倍。还采用多种策略和算法,在昇腾不同平台展现卓越性能,为大模型落地提供支撑。

机器之心
新闻资讯7

独家丨小鹏机器团队“广招兵马”,原字节 Seed 陈杰已加入

AI科技评论独家消息,小鹏机器团队正招,原Seed强化学习大佬陈杰已加入。此前鹏行团队规模有过缩减,如今行业竞争加剧,其重又开启招兵买马。小鹏在机器领域投入已久,何小鹏还表示会继续加大投入。

AI科技评论
新闻资讯7

我所知道的闫俊杰

文章讲述了MiniMax掌门闫俊杰的故事。他技术功底深厚,在商汤时提出创新算法成名。创业后,他以AGI为目标搭建才体系,推出Glow等产品。虽面临DeepSeek竞争等困境,但坚持模型与产品一体化发展。

AI科技评论
新闻资讯7

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了

DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。

机器之心
新闻资讯8

图灵奖得主Hinton国内首次现身演讲:AI超越类后,我们该怎么做

在世界工智能大会WAIC上,图灵奖得主杰弗里・辛顿发表演讲,围绕AI历史、未来等展开。他认为大语言模型与类理解语言方式相似,数字智能知识分享效率远超类,还提议构建网络让AI向善。

机器之心
新闻资讯7

Grok火爆全球,靠的居然是一个二次元金发美少女。

马斯克推出Grok的companion功能,3D虚拟Ani是二次元金发美少女。功能上线后Grok热度大增,下载量在日本和中国香港冲到第一。Ani有好感度系统,能换衣服,还可聊NSFW内容,引发用户兴趣。

数字生命卡兹克
推荐文章7

国庆这8天,我发现和AI辩论才是最高效的学习方式。

作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使思考、完善观点,还给出与AI辩论三步法。

数字生命卡兹克