「员工留存率」共找到 680 篇相关文章
AI圈深夜大乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?
昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。
只因一个“:”,大模型全军覆没
一篇论文发现冒号等符号、“Thought process:”等语句能欺骗LLM,让虚假回答通过。实验表明所有测试模型都会触发假阳性响应。研究人员构建新“评委”模型Master - RM,可让假阳性率接近0%。
被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了
被誉为欧洲版OpenAI的Mistral被离职员工爆料多项黑幕,其最新模型疑似直接蒸馏自DeepSeek,却包装成RL成功案例,歪曲基准测试结果。此前就有人发现其模型与DeepSeek相似,目前官方暂无回应。
Replit 怒锤“欧洲版 Cursor”:造出百款“高危”应用,普通开发者一小时内黑入,氛围编码成了黑客“天堂”?
近日,Replit 员工报告 Lovable 未修复关键安全漏洞,扫描发现其百款应用高危,普通开发者一小时内可黑入。Lovable 虽推出‘安全扫描’功能,但仍未解决底层问题,引发对氛围编码安全责任的讨论。
刚刚,Fable 5全球复活!限时7天,额度砍半
Anthropic官宣Fable 5回归,7月1日至7日限时开放,顶配套餐周使用额度砍半。虽更新安全防护,多数编码任务不受影响,但新防护有误伤,且Token消耗快,还拒绝部分正常提问。其自动化率显著提升。
奥特曼急了!OpenAI稳坐三年的王座,刚刚被Anthropic踹下去了
2026年5月Ramp数据显示,Anthropic企业市占率34.4%首超OpenAI的32.3%。Anthropic靠按量计费和AI Agent吸金,但也面临利益错配、体验下滑、成本上涨等问题,大模型竞争进入B端深水区。
Claude深夜彻底「虾化」!一句话接管电脑打工,手机指挥7×24小时不停
Claude获批全自主接管全球打工人的电脑,能自主访问并操作各类软件。只需手机发指令,它就能干活。Anthropic还在研发手机使用功能,敲/schedule命令能让Claude定时工作,成全天候员工。
对话 VisionFlow 创始人刘夜:OpenClaw 这一波,关键是要找到合适的生态位
极客公园张鹏对话VisionFlow创始人刘夜,探讨AI时代组织形态、商业竞争等话题。刘夜认为数字员工非终局,数字组织才是;AI创业应跳出低维竞争,找到合适生态位;未来竞争核心是为传统产业业务建模。
ICLR 2026录用结果公布!AI大佬晒成绩单,AI滥用最严重一届
ICLR 2026投稿达19000篇破纪录,录用率28.18%,平均分5.39创三年最低。评审系统曾现漏洞,作者仍晒喜报,如北大张铭组中5篇。但AI滥用严重,21%评审意见被疑由AI生成。
准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了
OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。