「METR报告」共找到 408 篇相关文章
刚刚,Claude Mythos敲响末日警钟!超级智能已在悬崖,Hassabis深感恐惧
前沿AI已能自主攻击、逃逸,Anthropic因太危险暂不发布Claude Mythos Preview模型。谷歌DeepMind掌门人Hassabis、OpenAI CEO奥特曼均发出警告,虽恐惧AI风险却仍推进开发。
刚刚,Anthropic深夜血洗500亿美金行业!代码审计末日来了
Anthropic的Claude Code新增代码评审功能,挑战500亿美元的传统代码审计行业。新工具成本低,能自动化评审,减少误报,准确率超多数人类评审员,或引发行业大洗牌。
中美安全公司经营对比及原因分析
国内网络安全上市公司财报多显示亏损,而美国同类公司增长与盈利能力强。分析指出,差距源于市场国际化、产品能力和人的因素。国内市场内卷,产品竞争力弱,部分公司决策和态度存在问题。
Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题
LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。
英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载
本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。
刚刚,OpenAI 称中国公司智谱让其感到害怕
OpenAI在官方博客发文《Chinese Progress at the Front》,点名中国AI公司智谱,称其在全球AI竞赛中取得显著进展,是真正值得关注的中国AI公司,智谱正快速向全球扩张。
OpenAI有个神秘邮箱,多大点事都能惊动奥特曼
OpenAI扩张中启用friction机制,员工遇问题可发邮件到friction@openai.com,重要问题能惊动高层。该机制由Fidji Simo制度化,虽有人不满,但在竞争中利于消除内部堵点,对手也各有管理法。
清华2年前预言,正成为全球共识!Meta等三大AI机构已得出同一结论
全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、大模型策略反转等。
今夜,OpenAI杀死了GPT-4o
2月14日凌晨2点,OpenAI经典模型GPT - 4o正式下线,引发用户强烈不满。大量用户悼念,有人取消订阅。此前OpenAI曾想下架它,用GPT - 5替代。此外,GPT - 4o微型版用于Retro Bio长寿实验,引发用户痛斥。
特斯拉Dojo超算团队突然解散!20人骨干被老领导打包带走
特斯拉曾为Dojo项目投入超10亿美元,虽有诸多规划,但2025财报不再提及,项目停滞。现Dojo团队解散,前负责人创办DensityAI,约20名成员加入,剩余员工将内部转岗。