评估问题」共找到 3746 篇相关文章

产品应用7

AI 视频生成“试金石”:谷歌 Veo 3 体操“图灵测试”未达标,仍是“抽象派”!

谷歌新出的Veo 3视频生成模型画质惊艳且能开口说话,但生成体操动作效果差,像“抽象派”。虽存在生成不准问题,但物理效果比其他模型好。有人建议其与专业动捕公司合作,音画一体或成视频模型竞赛标配。

AI进修生
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
推荐文章7

先说个暴论:不懂代码的人,才最喜欢 Vibe Coding。

文章指出不懂代码的人爱Vibe Coding,还介绍AI Coding赛道跨行、跨文件补全方向。分析基于AST的上下文构造、提升速度的方法,提及AI IDE采纳率问题,认为实际项目中NES可控度更高。

探索AGI
新闻资讯7

烧钱,能解决 AI 存储的焦虑吗?

存储短缺焦虑或延续至 2026 年,传统云存储因 AI 落地面临性能、成本等压力。InfoQ 联合腾讯云邀行业人士探讨成因、策略与竞争主线,还给出存储价值评估与规划方法,介绍文远知行和腾讯云实践。

InfoQ
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI政策频出,企业对AI应用需求攀升,倾向私有化部署,但行业面临技术错配等问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

AI工程化
算法论文8

联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像

图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。

机器之心
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout

文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。

AI大模型应用实践
推荐文章7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ
推荐文章7

Loop Engineering,4层循环自我进化

Loop Engineering旨在解决人工调度agent的问题,设计系统替人prompt。其系统是四层嵌套循环,从内到外分别让agent干活、干得对、知道何时干、越干越好,还指出优化循环结构收益渐增。

CourseAI