「数据飞轮体系」共找到 3020 篇相关文章
奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式
在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。
北大出品:全球首个支持生成华为鸿蒙应用的AI Agent来了
华为2025开发者大会上,华为终端CEO何刚点名「码上飞」AI Agent。它利用多智能体系统技术,实现开发全流程自动化,用户用自然语言提需求就能生成应用,实测5分钟可开发出睡眠助手app。
上下文工程的崛起:提示工程已是过去式
大模型应用从简单问答转向复杂智能体系统,技术焦点正从提示工程转向上下文工程。上下文工程核心是为大模型提供恰当信息与工具,其重要性日益凸显,且与提示词工程有明显区别。
0%通过率!Code神话泡沫!LiveCodeBench Pro发布!
国际算法奥赛金牌得主团队测试20个顶级大模型,在584道编程赛题上,高难度题目AI通过率为0%。论文发布LiveCodeBench Pro评测方法,揭示AI编程能力神话泡沫,指出其问题并给出提升方向。
揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon
在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。
Cursor CEO:拉开人与人之间差距的,是品位!
文章总结了Cursor CEO Michael Truell接受访谈的观点,包括未来写代码会落后、AI瓶颈在哪、Cursor自建编辑器原因、小众软件机会、品味的重要性,还提及Cursor的PMF和护城河,推荐看访谈视频。
CVPR2025视频生成统一评估架构,上交x斯坦福联合提出让MLLM像人类一样打分
Video-Bench视频评估框架由上海交通大学、斯坦福大学等团队提出,能让MLLM像人一样评估视频。它构建双维度评估框架,引入链式查询和少样本评分技术,突破现有评估方法限制,更全面智能地评分。
AI 渗透金融行业:大模型如何破解风控、服务与决策难题?
在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨大模型赋能金融,涉及风控、服务、决策等难题,分享了大模型应用场景、技术渗透、权衡可解释性与性能等观点。
“AI 将取代所有工作!”其实只是科技高管们在做营销,就像马斯克承诺的全自动驾驶汽车永远在下一年
作者Rand Fishkin寻找AI取代大量工作岗位的证据却无果。指出科技高管宣称‘AI会取代所有工作’是营销手段,形成‘AI恐惧与炒作营销飞轮’。历史表明技术进步多创造岗位,AI对就业影响小。
大概念模型:AI 推理的新范式
大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。