「人类工作」共找到 2051 篇相关文章
老黄呼吁所有企业「养虾」当天,阿里正规军入场,「悟空」把路铺平了
2026年初,OpenClaw火了,黄仁勋呼吁企业制定相关战略,但它存在环境依赖复杂等问题,企业不敢用。阿里发布企业级AI原生工作平台「悟空」,解决企业安全、工作流耦合和规模化等问题,被阿里重点布局。
不要建一千个 Agent:Ramp 如何用一个 Agent 搞定金融自动化
美国企业金融平台 Ramp 估值 320 亿美元,在 The Pragmatic Summit 分享 AI 实战经验。介绍了从“建一堆 Agent”转向“一个 Agent + 一千种技能”架构,Policy Agent 开发过程,定义“正确”标准,建内部 AI 基础设施及内部编码 Agent 情况。
ICLR 2026|多模态大模型真的理解情绪吗?MME-Emotion给出了系统答案
多模态大模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文大学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。
GPT-5.4「原生操控电脑」实测封神!OpenClaw天选模型来了
OpenAI发布GPT-5.4,首次实现原生电脑操控能力,几乎可操作电脑所有应用。它被认为是最适合跑OpenClaw的模型,在多方面表现出色,其发布标志AI从对话式到智能体的跨越。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
AI 唱得比顶流歌手还精准!周亚辉盛赞百倍跃进,高晓松直言:AI 和我不是一个创作机制
近日昆仑天工发布 Mureka V8 音乐大模型,昆仑天工董事长周亚辉称其标志 AI 音乐达大规模工业化应用成熟度。高晓松认为 AI 与自己创作机制不同,但也肯定其能力,当前 AI 音乐正重塑产业权益结构。
AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。
作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。
把大厂 10 年的职场经验,做成了一个「Coze Skill」—— 扣子 2.0 深度实测
作者实测扣子 2.0,介绍其「技能商店」功能,可将专家方法论封装成技能供调用。通过简历诊断、画架构图、生成 GEO 稿件三个场景展示提效作用,还提及「长期计划」功能,称扣子定位职场 AI,降低使用门槛。
万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021
雷峰网&AI科技评论邀三位老师探讨“AI大模型金融应用的机遇与挑战”。以Trading Arena大赛为例,分析大模型在金融投资应用,指出打造强逻辑推理“大脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。
AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年
2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。