「传统编程」共找到 2119 篇相关文章
用中等难度prompt做高效post training
近年来,RL后训练在LLM发展中至关重要,但传统方法效率低。本文提出PCL轻量级算法,通过动态选中等难度提示提升LLM后训练效率,经多基准实验验证其优越性,也指出方法局限与未来方向。
《中国Data&AI数据基础设施白皮书》——AI创生核心生产力,开启万亿新基建之路 | 甲子光年智库
全球正处地缘政治与AI技术变革中,AI跃升为核心生产力。中国企业面临‘挤压式转型’,传统数据系统难满足需求。数据厂商需构建新一代数据基础设施,技术上‘湖仓一体’与‘AI原生’融合,推动Data&AI一体化。
AI改造出行体验:滴滴的试验能否开启行业范式转变?
滴滴近日面向公众内测上线出行AI助手小滴,颠覆传统打车模式。它能精准理解需求,提供个性化方案,还可进行时空推理和订单规划。滴滴用工程打法攻克难题,还上线MCP服务助开发者定制助手。
华为超节点:用「一台机器」的逻辑,驱动AI万卡集群
在华为全联接大会2025上,华为基于自研灵衢互联协议创新超节点架构,重新定义大规模有效算力新范式。它能解决传统集群通信问题,还推出覆盖全场景的产品组合,并强调‘硬件开放、软件开源’生态战略。
B站出海的强有力支柱:最新开源文本转语音模型IndexTTS-2.0标志零样本TTS进入双维度时代
B站Index团队开源文本转语音模型IndexTTS - 2.0,引发关注。它解决了传统AR模型时长控制难题,实现零样本TTS双维度控制,在多方面表现优异,为B站出海及AIGC应用奠定基础。
刚刚,DeepSeek论文登上Nature,更多细节披露!
9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在多任务上优于传统模型。
Subagents:构建高可靠 AI Coding 专家顾问团
文章探讨 Claude Code 的 Subagents 功能在复杂 AI 编程场景的价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 可创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。
清华深研院等开源GUAVA:单图0.1秒出3D形象,打破数字人天花板
清华深研院和国际数字经济研究院的中国团队开源GUAVA,单图0.1秒就能生成3D形象,在速度、效果和成本上远超传统数字人制作流程。它结合EHM模型和3D高斯泼溅技术,有诸多应用场景。
综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满
该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。
仅靠5000+样本,全新强化学习范式让30B轻松击败671B的DeepSeek V3
传统强化学习在创意写作领域举步维艰,蚂蚁技术研究院联合浙江大学开源全新强化学习范式Rubicon,构建10000+条「评分标尺」,拓展应用至主观任务领域,其30B模型用5000样本超越671B的DeepSeek V3。