「联合评估」共找到 1709 篇相关文章
Kimi总裁张予彤北大实录:我们想要有抽象能力和偏执的人|甲子光年
Kimi总裁张予彤在北大分享,谈AI时代人才标准,偏好有抽象能力和偏执的人。还探讨AI创造新工作、学校课程设计、企业管理等问题,分享Kimi招人标准、组织特点及对行业诸多问题的看法。
回敬 Codex,Claude Code 推出 /goal 功能,不干完不睡觉
Claude Code随2.1.139版本推出 `/goal` 命令,设定完成条件后可持续工作至目标达成。它与Codex互相借鉴功能,且在设计上采用裁判分离,官方也给出目标制定建议,还带来其他更新。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
百度GenFlow 4.0发布,Office三件套全包了,还能养「牛马虾」
4月27日,百度文库与网盘联合发布GenFlow 4.0,全面升级Office Agent,支持在百度网盘多端部署OpenClaw。还推出「牛马虾」体系,适用于团队协作和企业场景。后续还将发布视频剪辑Agent能力和团队版「Agent协作军团」。
ACL 2026|清华新作ControlAudio:声音何时响、说啥话?都能按剧本可控生成!
现有文生音频技术在精细化控制方面有挑战,清华团队提出ControlAudio方法。它通过数据构造、渐进式训练和引导采样,在统一框架下实现时间与语音内容联合建模,在多项任务上表现优于现有方法。
AI学会左脚踩右脚自进化?Meta华人新研究改写Agent法则
Meta华人学者Jenny Zhang联合多机构研究者提出新智能体框架HyperAgents(DGM - H)。它打破任务能力与自我改进能力需对齐的局限,能跨任务自我改进,还自动生成基础设施,或改写Agent竞争规则。
被美国遣返、禁止入境 5 年,他在温哥华的卧室里做出了日处理 400 万工作流的 AI 平台
Gumloop联合创始人兼CEO Max Brodeur - Urbas,曾被美国遣返并禁入5年,他批判AI营销泡沫,认为应‘AI加持而非替代’,强调21 - 23岁创业窗口期,还分享了创业历程与AI使用见解。
OpenClaw 火了半年,Agent 执行层依然是工程空白
当前主流 Agent 工具链执行层基本空白,Violoop 是少数在执行层做系统化设计的项目。它是桌边触屏硬件,获取三类运行时数据,具备感知 - 判断 - 执行运行时,有多种核心能力,适合特定场景团队评估。
如何定义“人味儿”?——HeartBench评测体系建设实践
在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。
VAST完成5000万美元A轮融资,加速构建世界模型与UGC互动内容平台
通用人工智能公司 VAST 完成 5000 万美元 A 轮融资,由阿里、恒旭资本联合领投。该公司在 3D 领域成果显著,发布全新 AI 3D 大模型家族,还将重点投入世界模型研发和 UGC 互动内容平台建设。