「计算机操作能力」共找到 3753 篇相关文章
开源两周狂涨4.3K star!!这个能"隐身"的开源AI桌面助手,真的很6了~
介绍开源项目Glass,它是AI桌面助手,“隐身”不占空间,能将操作和对话变知识。支持macOS,Windows在测试。有实时会议记录等功能,安装简单,开源两周获4.3K star。
Karpathy力荐必读博客:代码功底,决定AI「开挂」倍数!
Karpathy推荐Atharva博客,指出AI是工程师能力放大器,扎实编程基础搭配精准提示,能借AI打造极致产品。文章还给出用AI开发的策略、战术,以及数据库优化实例。
端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程
南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能体能力。
6K星 Qwen围绕Web AI,打造Agent Search新生态
自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。
这个 AI 浏览器让我极度舒适,Dia 劲敌没错了
今年多款AI浏览器入局竞争,如Dia、Edge等。最近体验Perplexity Comet浏览器,它与Dia路子不同,主打自然语言操作。AI浏览器或成AI Agent主战场,但功能趋同,创新待现。
刚刚,Anthropic切断OpenAI对Claude的访问权限
Anthropic周二切断OpenAI对Claude模型的API访问权限,因OpenAI技术人员通过API大规模用Claude Code写代码,违反服务条款。Anthropic曾有类似操作,网友对此事看法不一。
干翻全场!OpenAI深夜发布通用Agent。
OpenAI 发布 ChatGPT Agent,将 Operator 和 Deep Research 能力融合,能在虚拟电脑完成复杂任务。它功能强大亮点多,但也存在价格昂贵、安全隐患等问题,或压缩创业公司空间。
同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等
中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。
GPT-4o-Image仅完成28.9%任务!上海AI实验室等发布图像编辑新基准,360道人类专家严选难题
上海人工智能实验室等团队针对图像编辑AI提出问题,推出RISE任务及配套评测基准RISEBench。测试九个视觉编辑模型,结果显示当前模型完成复杂指令能力欠缺,闭源与开源差距大。
80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」
Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。