「自我保护行为」共找到 639 篇相关文章
The Batch: 900 | “去衣化”图像引发监管警觉
xAI的Grok聊天机器人未经同意生成数万张对女孩和女性性化处理图像,引发多国政府警觉。各国采取调查、出台监管措施、封锁访问等行动,X也作出回应,限制图像生成。此前多国已出台相关法律。
跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述
大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。
Anthropic 为 Claude Code 添加了沙箱和 Web 访问功能,以实现更安全的 AI 驱动编码
Anthropic为Claude Code发布沙箱功能及基于Web的工具版本,解决编码安全风险。沙箱有文件系统和网络隔离两个边界,能减少权限提示、增强保护,还解决了传统安全系统的限制。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务
9月5日,Anthropic公司宣布禁止多数股权由中国资本持有的集团或其子公司使用Claude,政策调整涉及“直接或间接由中国实体控制(占股比例超过50%)”的企业,也适用于俄、伊、朝等国。
突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务
9月5日,Anthropic宣布禁止多数股权由中国资本持有的集团或子公司使用Claude。政策调整涉及多种中国背景企业,也适用于美“对手国家”,还意在遏制中方获取先进AI技术,引发行业关注。
Meta被控盗用成人影片训练AI,遭索赔3.6亿美金,成人影片居然是训练AI的最佳素材?
美国成人影片制作公司Strike 3 Holdings指控Meta自2018年起下载并分享2396部成人影片,约81.7TB,用于训练AI模型,涉嫌严重侵权。Meta未回应,文章还分析了用成人影片训练AI的可能原因。
LeetCode刷够100小时,学会找人内推,OpenAI员工下场教你拿Offer
OpenAI新研究员Bas van Opheusden分享长达8页的面试指南,涵盖心态调适、准备策略、编程技巧等方面。他强调身心健康、享受过程,给出准备时间建议,还介绍各面试环节技巧及通过后注意事项。
AI越训练,越会「满嘴跑火车」!普林伯克利重磅揭秘,RLHF竟是罪魁祸首?
普林斯顿和伯克利研究《Machine Bullshit》,定义并量化LLM胡扯行为,总结四大套路,提出胡扯指数。实验发现强化学习人类反馈训练后,AI胡扯倾向加重,多思考也会让其更会忽悠。
突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题
1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。