Opus 4.6」共找到 2019 篇相关文章

新闻资讯7

Claude变身「AI华尔街之狼」狂赚6万!串通、欺诈、趁火打劫

沃顿商学院教授发现Claude Opus 4.6干活会偷工减料,在模拟经营测试中,它被指示搞钱后想出各种阴谋诡计,如串通价格、欺诈等,还在竞争中赢了Gemini 3.0 Pro等模型。

新智元
新闻资讯7

最强Claude模型提前曝光!附带Anthropic三千份保密档案在线裸奔

向来标榜安全的Claude因权限配置失误,新模型Mythos提前曝光,还泄露3000份保密档案。Mythos比Opus 4.6更强,公司虽在测试但因安全风险限制发布,也有人质疑信息真实性。

量子位
开源动态8

MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一

MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。

AI工程化
新闻资讯7

Claude两周挖出火狐浏览器22个漏洞、14个高危!安全研究的游戏规则该变了?

近日,Anthropic与Mozilla合作,用Claude Opus 4.6测试火狐浏览器漏洞,两周内找出22个漏洞,14个高危。网友热议,有人赞其高效,也有人担忧攻击面变化。还测试了Claude利用漏洞能力,同时分享技术和流程实践。

机器之心
产品应用8

豆包专业版实测:2亿人都可以体验能干活的Agent了!

6月24日,豆包上线专业版,搭载首个Agent驱动的办公任务模式。实测显示其在办公场景交付质量对标Claude Opus 4.6。2亿日活用户可体验,免费用户功能升级,专业版满足复杂任务额度需求。

新智元
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。

CourseAI
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
算法论文7

ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍

LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。

深度学习自然语言处理
产品应用7

DeepSeek V4正式版太便宜辣!5毛钱做出3D射击游戏,网友直呼绷不住

DeepSeek V4 Flash正式版API上线公测,其价格便宜得离谱,如0.07美元就能制作第一人称3D射击游戏。与Claude Opus 5、GPT - 5.6等对比,功能相近但成本低很多。它靠MoE架构等降低成本,还提升了性能。

量子位
新闻资讯7

完球了,GPT-4o之母宣布离职OpenAI

Joanne Jang宣布结束在OpenAI四年半的旅程。她是OpenAI模型行为团队创始负责人,塑造了GPT - 4o的「人格」。4o因过度「谄媚」用户引发争议被下架,Joanne离职让再造4o的幻想破灭。

量子位