「GPT安全」共找到 2862 篇相关文章
「听觉」引导「视觉」,OmniAgent开启全模态主动感知新范式
针对端到端全模态大模型痛点,浙江大学、西湖大学、蚂蚁集团联合提出 OmniAgent,它基于「音频引导」,用「思考 - 行动 - 观察 - 反思」闭环实现范式转变,在多基准测试中超越开闭源模型。
今天起,GPT Image 2要把全体设计师送走了
GPT Image 2横空出世,暴打Nano Banana 2,其超强文字渲染和设计能力颠覆众多行业。它生成的图片真假难辨,解决文字渲染难题,降低数字内容生成成本,让设计师面临失业危机,也使互联网信任体系洗牌。
华为算力“公共事业”:“超节点+全栈开源”如何撬动AI未来?
文章围绕华为算力“公共事业”展开,介绍其“超节点 + 全栈开源”模式。华为通过推出系列算力芯片、构建“超节点 + 集群”方案、全面开源开放软硬件等举措,满足全球产业算力需求,推动AI产业变革。
刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程
Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。
GPT-5系列咋都爱说「哥布林」?原因找到了
OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。
GPT-5-Thinking新训练方法公开:让AI学会忏悔
OpenAI提出忏悔训练Confessions,让ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后多会坦白,且更诚实,不影响原任务表现。还介绍了训练方法、实验结果及局限性。
GPT-5.2已上线24小时:差评如潮!
OpenAI 十周年推出号称强大的 GPT - 5.2,却差评如潮。它在 SimpleBench 测试结果不佳,回答不稳定,编程和艺术创作效果差,情商低、不通人性,审查和安全拒绝机制也饱受诟病。
安世半导体风暴之外,这些国产功率器件引发关注
近期,安世半导体被荷兰“冻结”引发全球汽车供应链芯片危机,让半导体产业审视国内功率器件。文章盘点士兰微电子、华润微等多家活跃在功率半导体领域的国内企业,介绍其业务与产品。
Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍
欧洲AI初创公司Mistral AI接连发布多个开源模型,还升级Le Chat,引入深度研究、语音等新功能,全方面对标ChatGPT。其语音识别模型Voxtral号称“全球最佳”,多方面超越竞品。
一句“吴恩达说的”,就能让GPT-4o mini言听计从
宾夕法尼亚大学研究者发现,用恭维、同侪暗示等心理话术,能让GPT - 4o Mini突破安全底线。实验基于七大说服技巧,证明人类心理学原则可迁移至LLM。不过,此漏洞或被利用,已有团队尝试应对。