训练问题」共找到 4900 篇相关文章

产品应用7

给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐图,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题

AI科技评论
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
产品应用7

小红书,再造一个更有「声」命力的社区

2026年春节,小红书开放多种AI语音新玩法,如语音发布、评论、问一问等,增强社交趣味性。但AI语音落地面临音频理解、生成活人感和响应速度等问题。小红书有天然优势,技术团队自研模型达SOTA水平。

机器之心
产品应用8

AI编程冲刺“DeepSeek时刻”:00后团队用国产模型一键直出复杂应用,效果超越Claude Code

云端Agent有新进展,重新定义AI编程范式。Vinsoo上新Beta 3.0版本,仅用国产大模型就超越一众流行AI编程产品。它解决了4个核心技术问题,还带来三重云端AI Agent新体验,其研发团队由00后主导。

量子位
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。

量子位
新闻资讯7

告别传统存算分离,AI时代数据底座迎来全新底层逻辑

文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。

AI前线
推荐文章8

“AI 在一线:开发人员如何重塑软件开发流程” |圆桌讨论

文章是关于“AI在一线:开发人员如何重塑软件开发流程”的圆桌讨论,多位嘉宾分享了AI辅助工具对软件开发的影响,包括加速原型设计、缩短项目时间等,也提到了局限性和需注意的问题,如信任和度量标准。

InfoQ
算法论文8

中科大 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新

中科大与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。

深度学习自然语言处理
新闻资讯8

云计算一哥,给 Agentic AI 工程做“减法”

2025 年亚马逊云科技 re:Invent 大会聚焦 Agent,其首席执行官提出未来各领域将运行数十亿 Agent。该公司欲在 Agentic AI 上重构,推出系列工具,如 Amazon Strands Agents SDK、Amazon Bedrock AgentCore 等,还在模型训练和工程化方面做减法。

InfoQ
新闻资讯7

田渊栋被裁后新offer排到法国!原来Llama 4.5训完后被卸磨杀驴了

Meta此次裁员引发诸多争议,工作超十年的田渊栋整组被裁。有说法称是因没做出基于Llama 3的推理模型,但田渊栋否认。Llama 4.5训练好后团队被裁,且后续还将裁风控部门。不过田渊栋获多家公司青睐。

量子位