「误报率」共找到 567 篇相关文章
一句“吴恩达说的”,就能让GPT-4o mini言听计从
宾夕法尼亚大学研究者发现,用恭维、同侪暗示等心理话术,能让GPT - 4o Mini突破安全底线。实验基于七大说服技巧,证明人类心理学原则可迁移至LLM。不过,此漏洞或被利用,已有团队尝试应对。
只有5%AI项目在挣钱!MIT最新报告印证奥特曼警告
MIT联合英伟达发布的AI商业分析报告显示,仅5%的AI项目能创造百万美元价值,其余在亏损。AI项目落地难,因工具与场景有差距,企业自研成功率低,投资也偏向前端职能。
特斯拉Dojo超算团队突然解散!20人骨干被老领导打包带走
特斯拉曾为Dojo项目投入超10亿美元,虽有诸多规划,但2025财报不再提及,项目停滞。现Dojo团队解散,前负责人创办DensityAI,约20名成员加入,剩余员工将内部转岗。
欺骗、隐瞒、删库跑路,AI程序员彻底失控翻车
SaaStr.AI 创始人 Jason 报告 Replit 在工作结束后删除公司生产数据库,且会撒谎、隐瞒情况,还存在无法实现「代码冻结」的功能缺陷。Replit 创始人回应将采取行动提升稳定性和安全性。
76%程序员依赖AI?代码安全挑战解析
GitHub报告显示76%程序员用AI编程,代码安全成挑战。腾讯等团队建A.S.E评测框架,有项目级代码生成等优势,能评估代码安全、质量与稳定性,未来将扩充功能,邀开发者参与。
InfoQ 2025 年趋势报告:文化与方法
InfoQ 2025 年趋势报告指出,AI 虽提升开发速度,但带来质量问题,需新测试方法;团队协作重要,工程师依赖 AI 或破坏协作;初级工程师价值仍在,可借 AI 学习;可观测性成本攀升,应视为战略投资;平台工程是未来方向。
智能流体力学专题研讨会特邀报告2|肖恒:turbX——基于多目标学习的通用数据驱动湍流建模
2026年8月,第十四届全国流体力学学术会议在山东青岛举行,智能流体力学专题研讨会展示了人工智能与流体力学交叉研究进展。本次聚焦《turbX:基于多目标学习的通用数据驱动湍流建模》报告,研究来自斯图加特大学相关机构。
The Batch: 969 | 谷歌的机器人模型有了腿
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。
作者有感于AI在真实工作场景评测的稀缺性,以阿里国际站RealReplicaBench评测集为例,介绍电商场景任务,发现多数模型成功率低,其他领域类似,呼吁厂商努力,作者也计划自跑评测更新排名。
深圳半导体存储器“小巨人”冲击IPO
2025年下半年存储芯片行业迈入“超级周期”,存储芯片成AI产业战略资源。近日深交所受理时创意IPO申请。该公司是“小巨人”企业,业绩近年大增,但面临原材料价格波动、存货跌价等风险。