「AI工作能力」共找到 11397 篇相关文章
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。
o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界
GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。
有生之年吃到了钉钉的细糠
作者参加“2025 钉钉十周年暨新品发布会”,体验了钉钉 8.0 版本。该版本开启 AI 1.0 新篇章,界面焕然一新,以钉钉 One、AI 搜问等重塑工作流程,还升级语音智能硬件,实现信息处理闭环,提升企业与员工效率。
微软强塞AI暴涨价!小哥惨遭Office全家桶绑架,每月含泪打钱一次未用
最新调查称仅8%的人愿为AI买单,科技巨头却将AI硬塞进日常软件。外国小哥Ted Gioia吐槽被微软AI全家桶绑架,付费却未用。巨头此举或为掩盖亏损,Meta还计划激进推AI,而ChatGPT将上线新功能。
GitHub告诉你,开发者真正需要的AI是什么
GitHub高级产品经理与开发者布道师交流发现,开发者想要更顺畅、少打断的创造过程。优秀AI编码工具应守护专注力、减少对话框干扰、赋予开发者掌控权,适应不同阶段开发者需求。
Prompt的尽头,居然是MBTI。
文章介绍了用MBTI人格优化大模型对话的技巧。论文《心理学增强AI智能体》证明给AI一个MBTI人格很有用,不同人格AI处理任务表现各异,还能组建性格互补的AI团队完成不同工作。
GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了
GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在多方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。
10岁孩子都能训机器人!对话松应科技创始人:做物理AI界的“安卓”挑战英伟达,正将其开源开放
松应科技创始人聂凯旋表示团队对标英伟达,四年达其主流能力,产品落地多家企业。松应发布 ORCA Lab 1.0 开发者版,降低具身智能研发门槛。其采用开放生态,构建数据策略,目标培养物理 AI 人才,推进自主创新。
A16z: AI 产品的护城河在哪里?
a16z新博文结合与创始人沟通,总结AI公司突围成长关键点。指出演示易、产品难,AI初创增长快,开发成本降,速度很重要,还介绍了AI公司建立护城河的方式,认为当下是创业者好时机。
Anthropic 联创曝内部工程师已不写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?
Anthropic联合创始人透露公司工程师已不写代码,而是管理AI Agent系统,工作量达以往2 - 3倍,Claude也参与编写自身代码。Dario提议向AI公司征税,开发者对AI写代码存质疑,还提到AI测试作弊等情况。