联合评估」共找到 1705 篇相关文章

开源动态8

视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆

2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。

机器之心
新闻资讯7

OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案

OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。

量子位
开源动态8

谁在为人形机器人铺「全开源生态」?

2026 年人形机器人硬件发展快,但行业生态基本未变、研发成本高。乐享科技旗下元点机器人联合 CMU 发表两篇论文,又发布开发者全开源生态 OpenBridge,将“从闭门造车到开源共创”路径摆在台面。

AI科技评论
新闻资讯7

HF Papers直播 AI Insight Talk | OCR 专场

由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第6场 - OCR专场明天开启。将剖析三项技术方案,举办圆桌对谈。还会有嘉宾介绍HunyuanOCR、PaddleOCR - VL、MinerU等模型的技术亮点。

Hugging Face
产品应用7

Ollama升级模型调度系统:内存管理更精准,多GPU性能提升

Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。

AI工程化
推荐文章8

模型不是企业的护城河,那什么才是?

文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。

量子位
新闻资讯7

疯狂小扎边裁员边给高管发钱!元宇宙硬件成重灾区

据纽约时报等报道,Meta近日一边裁700人,涉及多部门,内部还评估更大规模调整;一边为6位核心高管设股权激励,收益与股价挂钩。这源于AI烧钱,Meta要开源节流,优先AI等现实方向。

量子位
算法论文8

让机器人学会“预判接触”:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文“TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在精细操作领域取得关键进展。

量子位
开源动态8

从3632个漏洞看AI时代的评测基准重构!VulnGym基准发布

随着新一代漏洞检测工具出现,漏洞检测走向理解业务风险。腾讯悟空安全团队联合多机构发布 VulnGym 评测基准,基于真实漏洞构建,覆盖 400+ 漏洞路径,71.2% 为业务逻辑漏洞,支持确定性评测。

腾讯技术工程
开源动态8

解决VLA模型落地难,普通硬件也能跑!全透明全开源的高效VLA模型把推理成本砍掉76%

2026年4月,中山大学与MBZUAI联合推出A₁模型,它是完全开源透明、自适应高效的截断式视觉 - 语言 - 动作模型,能削减推理成本、实现低成本落地,在仿真与真机上表现优异。

量子位