「训练数据生成」共找到 5616 篇相关文章
谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍
大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。
一张图片+ 一条音频,照片开口说话唱歌,多角色、情绪控制都拿捏了。
腾讯混元联合腾讯音乐推出 HunyuanVideo - Avatar 模型,上传照片配音频就能生成动态视频。支持多风格角色、情绪控制和多角色对话,单角色模式已开源,技术有创新,在多数据集表现优。
爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了
最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。
WSL、Copilot皆重磅开源,深夜炸场的微软给我们带来了哪些惊喜?
今年微软 Build 2025 大会于 5 月 20 日凌晨开场,AI 是重要战略方向,‘开源’成关键词。大会有诸多亮点,如开源 Copilot 核心功能和 WSL,升级开发者工具,推出新智能体和平台等,还与多方探讨 AI 发展。
谷歌AlphaEvolve引发OpenAI关注:AI原创算法,正挑战人类专家界限
谷歌DeepMind推出的AlphaEvolve系统,结合Gemini模型与进化算法,能自主探索、生成并迭代优化算法代码。它优化经典算法,在多领域取得突破,其原创能力引业界关注,OpenAI研究员对此表示震撼。
这场巅峰对话,把China AI的基因、堵点和未来聊透了|甲子光年
2025年4月28日,甲子光年大会巅峰对话探讨‘China AI如何重塑全球AI价值坐标系’。大模型、算力、具身智能、芯片领域嘉宾各抒己见,谈China AI基因、应对策略、行业堵点及未来判断。
RAG系统设计:揭秘语义搜索被低估的核心价值与KG驱动的架构选型策略
在AICon大会上,Hugging Face的尹一峰探讨基于语义搜索的RAG系统重要性,揭示其被低估原因,分析本质与作用,分享设计高效架构方法,还讨论KG驱动的RAG系统及范式选择。
AI辅助编码将如何改变软件工程:更需要经验丰富的工程师
文章指出生成式AI改变软件开发方式,LLM在编码领域成果显著。但AI辅助编码有局限,如‘70%问题’。还介绍有效模式,提及软件工程智能体兴起,最后认为未来对经验丰富工程师需求或增加。
世界模型的范式之变:因果思维链开始推演未来如何发生
本文探讨世界模型的范式变革,介绍Aether AI推出的引入因果思维链的具身世界模型CausalWM,该模型在多项公开评测中取得领先成绩,分析因果推理对具身智能落地的核心价值,展望其在多领域的应用前景。