「安全训练」共找到 2971 篇相关文章
Fable第一,谁第二?Anthropic钦点8款模型名单曝光
Anthropic官宣Claude Fable 5全球上线,公布安全测试结果,8款模型包括中国的Kimi K2.7。北美公司也用行动认可中国模型,Kimi在多方面表现出色,其商业模式类似Anthropic,未来潜力大。
Anthropic 最新播客:如何打造下一代 Claude
Anthropic的Alex Albert上播客揭秘Claude产研流程,涵盖模型规划、用Claude处理反馈、记忆“做梦”机制、性格训练等,还谈及AI对PM工作方式的重塑,以及单向门决策框架等内容。
还需付费卸载龙虾?这只龙虾能直接「杀死」OpenClaw
OpenClaw曾引发安装热潮,如今因安全风险引发卸载潮。国家相关部门发布风险提示,网上出现卸载服务。而GenericAgent既能装也能卸OpenClaw,还能自我卸载,展现出硬核技术。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
连肝36小时不睡!00后天才工程师,瘫坐特斯拉靠FSD保命
xAI工程师Parsa Tajik连续工作36小时后瘫坐特斯拉发X平台,同事纷纷叫好,马斯克也回应。xAI秋天忙碌,此前有裁员等情况。Tajik回应网友担忧,称拼车靠FSD安全回家。
Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏
Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练中奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。
Ilya、小扎之后,苏莱曼的「超级智能」进入7年倒计时!
主流AI公司从谈AGI转向「超级智能」。微软AI CEO苏莱曼宣布成立MAI超级智能团队,他定义的超级智能是人本主义的,重点布局三个领域,还面临安全可控等挑战,微软有7年窗口期。
Databricks与OpenAI合作:企业级私有化GPT-5来了
OpenAI和Databricks深度合作,将把GPT - 5等模型原生集成到Databricks平台。企业可在自有数据环境运行模型,通过SQL等调用,Mosaic AI Gateway保障数据安全,多家企业表示期待。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业开展AI培训却难转化业务价值。极客时间与制造企业合作,用“线上+线下+实战”的OMO训练营,实现AI产品经理“能力复制”,成果获认可,模式可复制。
刚刚,李飞飞主讲的斯坦福经典CV课「2025 CS231n」免费可看了
斯坦福大学经典CV课程《CS231n:深度学习与计算机视觉》(2025春季)正式上线,学生能学习实现和训练神经网络。课程由李飞飞等四人主讲,全部18个视频可在Youtube免费看。