GAN训练法」共找到 2412 篇相关文章

算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
推荐文章8

想成为一名合格的 AI PM,先抛弃过去那些让你成功的经验

文章指出 AI 产品经理与传统产品经理不同,AI 是会演进的系统。掌握 AI 产品策略是 PM 首要技能,从方向、差异化、设计、部署、领导力五阶段构建策略,还介绍了结构化实验方,无策略的 PM 将被淘汰。

Founder Park
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI 发布 GPT - 5 进军企业市场,虽发布不顺利,但部分初创公司和企业客户反馈其在复杂任务表现出色、价格低廉。OpenAI 联创 Greg Brockman 揭秘 GPT - 5,称其代表‘几乎难以形容的智能’,是科研好伙伴,还探讨算力、模型训练等问题。

InfoQ
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。

量子位
算法论文8

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。

机器之心
算法论文8

中科大 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新

中科大与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。

深度学习自然语言处理
开源动态8

DeepSeek 模型技术之旅:从 V3 到 V3.2

本文深入剖析了 DeepSeek 模型从 V3 到 V3.2 的技术演进,对比了基座与推理模型,介绍了架构、训练变化,如 V3.2 结合 MLA 与 DSA,更新奖励和 GRPO 算,还提及 V3.2-Speciale 扩展思考特性。

深度学习自然语言处理
新闻资讯8

云计算一哥,给 Agentic AI 工程做“减

2025 年亚马逊云科技 re:Invent 大会聚焦 Agent,其首席执行官提出未来各领域将运行数十亿 Agent。该公司欲在 Agentic AI 上重构,推出系列工具,如 Amazon Strands Agents SDK、Amazon Bedrock AgentCore 等,还在模型训练和工程化方面做减

InfoQ