成果评估」共找到 1415 篇相关文章

推荐文章8

从 0 到 1 做一款 AI 产品:技术怎么搭、成本如何控制、销售策略怎么定?

独立开发者 Arvid Kahl 分享从零构建 AI 播客产品 Podscan 及「节俭工程」经验,涵盖技术搭建、成本控制与销售策略调整。如用小众云服务降成本,从 PLG 转向 SLG 等,为小团队创业者提供实用借鉴。

Founder Park
新闻资讯8

挤不动的世界机器人大会上,自变量秀出了真·通用具身智能

2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。

机器之心
推荐文章8

长上下文不再难:KV Cache 全生命周期优化实战

长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果

AI前线
算法论文8

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。

机器之心
新闻资讯8

来自 OpenAI 离职员工的爆料:关于 OpenAI 的一些思考

OpenAI 前员工分享工作感悟,谈及公司文化、代码管理、个人收获及 Codex 发布情况。指出公司成长快但扩张中问题多,文化自下而上且精英主义,代码库大且围绕聊天构建,Codex 发布迅速成果佳。

宝玉AI
新闻资讯8

第一作者必须是AI!首个面向AI作者的学术会议来了,斯坦福发起

斯坦福大学宣布将于2025年举办科学AI智能体开放会议,投稿要求第一作者必须是AI,由其主导论文创作。会议评审主要用AI,人类专家最终评估。目标是探索AI驱动科研的未来,建立规范。

机器之心
产品应用8

MiniMax秀了波AI视频杂技:越看越惊艳,指令遵循太强了

MiniMax发布海螺2.0版本,能处理极端物理情况,原生支持1080P,在指令遵循、生成质量达一流水平,成本效率破纪录。此前还开源MiniMax - M1,两大底层技术创新让其成果惊艳,展现研发实力。

量子位
新闻资讯8

LeCun亲自官宣!Meta世界模型V-JEPA 2登场!仅用62小时机器人数据,就能实现零样本控制!

Meta发布V-JEPA 2世界模型及三个新基准测试,Meta首席AI科学家Yann LeCun介绍其不同。V-JEPA 2基于视频训练,用62小时机器人数据就能实现零样本控制,还将探索分层式模型和多模态建模。

AI科技大本营
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。

量子位
算法论文8

北大伯克利联手“拷问”大模型:最强Agent也才40分!新基准专治“不听话”的AI分析师

北大与伯克利团队推出IDA - Bench新基准,模拟真实数据分析场景,解决现有基准无法评估大模型在动态交互中可靠性的问题。测试显示,顶尖大模型成功率最高仅40%,不同模型还暴露多种问题。

量子位