「Opus 5」共找到 2051 篇相关文章
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
Gemini 2.5 Pro 负责人:最强百万上下文,做好了能解锁很多应用场景
谷歌DeepMind长上下文预训练联合负责人Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。
感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义
伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。
OpenAI 盲测新模型不如 Nano Banana Pro?曝 Altman 要暂停 Sora,死磕 ChatGPT
近日,网友发现 Notion 或在测试 GPT - 5.2。OpenAI 盲测新图像模型‘Chestnut’和‘Hazelnut’,结果接近 Nano Banana Pro,但生成图未获好评。Altman 调整战略,暂停 Sora 死磕 ChatGPT,本周将推 GPT - 5.2。
AI编程新王Claude 4,深夜震撼登基!连续编码7小时,开发者惊掉下巴
Anthropic发布全球最强编程模型Claude 4,含Opus 4和Sonnet 4。Opus 4是顶尖编码模型,Sonnet 4是Sonnet 3.7的重大升级。还发布系列产品,Claude 4定价与此前一致,部分用户可体验。
奇点临近!全球AI终局战,只剩OpenAI和Anthropic的双人舞
全球AI终局战,只剩OpenAI和Anthropic双雄争霸。OpenAI的GPT-5.5展现指数级跃迁,Anthropic的Claude系列也有稳定加速,但面临算力危机。谷歌投资Anthropic,自身Gemini掉队,其他玩家也难跻身第一梯队。
Clawdbot再次更名:新名OpenClaw,官宣支持Kimi K2.5和小米MiMo
两个月前Peter Steinberger搭建的项目,最初叫WhatsApp Relay,现获超10万GitHub星标、单周200万访问者。1月29日正式更名为OpenClaw,它是开源AI助手平台,此次发布新渠道、支持新模型等。
居然 11.5K star 了,这个一人公司的秘密项目有啥魔力!
做自媒体和内容运营重复工作多、效率低。开源项目`AiToEarn`用AI+自动化整合内容创作、发布等环节,支持多平台,有11.5k+ star,还介绍了安装使用方法。
告别胶水代码,5倍飚速!无问芯穹首次揭秘,Infra智能体蜂群登场
无问芯穹推出基础设施智能体蜂群,这是新一代基础设施智能化解决方案。它封装多个智能体模块,构建全生命周期智能闭环,提升资源利用率等。在重点客户业务流程落地效果好,能让开发者解放价值。
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。