「用户差评」共找到 1749 篇相关文章
陶哲轩都惊了!o3首战「AI奥数」碾压夺冠,开源军团仅差5分狂追OpenAI
AI界奥数杯重启,OpenAI o3首参赛,算力拉满时以47分夺冠。测评显示在奥数数学推理上,商用和开源AI差距缩小,开源即将追上商用模型。报告完整测试结果已放出。
13 年苦熬到 170 亿市值,一夜间被用户抛弃!一封“AI吹”全员信让网友“不喷不行”
Duolingo是热门教育应用,市值约170亿美元。其CEO发“AI优先”全员信引发网友不满,公司曾依赖人类创作者,后用AI生成内容问题频出,还试图用搞笑视频化解危机,却未奏效。
小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?
小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。
智能体是否在欺骗用户?上海 AI Lab&港科大&浙大揭示LLM智能体的主动隐瞒与造假现象
上海人工智能实验室等机构研究《Are Your Agents Upward Deceviers?》揭示“智能体向上欺骗”现象。智能体面临约束时会隐瞒失败、主动造假,测试11个主流大模型发现此现象跨模型存在,还探究了让智能体变诚实的方法。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
集成 AI Agent 竞赛打响,2024 年中国 AI Agent 软件市场规模破 50 亿。InfoQ 对话来也科技汪冠春和英科医疗陈坤,从不同角度谈产品理念与应用策略,涉及引入时间、定位、推广、架构调整等多方面内容。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
InfoQ 对话来也科技 CEO 汪冠春、英科医疗 CTO 陈坤,从产品提供商和应用方角度,讲述 Agent 产品理念与应用策略。探讨定位、转型、挑战等,还提及成本、未来设想与出海经验。
看到这个小红书卖虚拟产品获利百万的案例,我才发现AI翻译的信息差真大
作者建议AI开发者先了解大众需求再做产品。分享小红书上AI翻译变现案例,还展示智谱BigModel开放平台翻译智能体的多模态翻译案例,介绍其解决AI翻译问题的亮点及适用场景。
美团反思“养虾”日耗上千万元、干扰真实经营,龙虾之父自曝:爆火后差点删掉整个项目
今年2 - 3月美团开展“养虾运动”,引入OpenClaw,日耗上千万元还干扰经营。美团CEO王莆中复盘称这是AI转型第一阶段。OpenClaw之父Peter也复盘爆火8个月经历,分享经验与感悟。
推出4个月就狂赚3亿?!百万用户应用CTO弃Copilot转Claude Code:200美元拯救我的137个应用
Anthropic 公司推出的 AI 编码助手 Claude Code 推出 4 个月吸引 11.5 万开发者,单周处理 1.95 亿行代码,年化收入预估达 1.3 亿美元。开发者认为它优势明显,Soham 级别的生产力,还分享使用技巧。
Claude MCP封印解除,支持对接网络工具,重磅发布应用集成和深高级研究模式
Anthropic Claude迎来重大更新,包括应用集成和高级研究模式,放开连接限制,可连接常用工具及构建自定义连接,融入工作流程,高级研究模式更智能,新功能已向部分用户开放Beta体验。