「大模型替代」共找到 9536 篇相关文章

开源动态8

开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录

格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。

量子位
产品应用8

Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Anthropic推出Claude Opus 5.5后,开发者普遍遇到AI Agent干一半就停工的问题,本文整理官方最新指南,揭秘原因,梳理API升级坑点,给出解决方案与实用调优建议。

新智元
推荐文章9

姚顺宇、施天麟聊 RSI:最难的不是实现自我迭代,而是如何验证迭代有效

本文整理自AGI House上海RSI主题圆桌讨论,姚顺宇、施天麟等业内专家围绕RSI定义、落地成果、核心卡点、产业分工展开讨论,指出RSI验证迭代有效性才是当前最大难点。

Founder Park
开源动态9

推理成为新中心、Agent 把生产级问题提前:AI Infra 的边界正在被重写

本文基于多开源社区联合大会的行业交流,分析AI落地生产后对基础设施的改变,指出推理成为新中心,Agent提前带出生产级问题,AI Infra边界正被重写。

InfoQ
新闻资讯8

GPT-6 Astra发布,多个基准测试接近满分,“欢迎来到AGI时代”?

当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在多测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。

DeepTech深科技
新闻资讯7

Shopify CEO考虑禁用Claude Code,因其不兼容AGENTS.md

Shopify CEO Tobi Lütke 考虑在 Shopify 禁用 Claude Code,因其坚持读取`CLAUDE.md`,与团队常用的`AGENTS.md`等不兼容,可能使开发者获不同项目规则。开发者社区给出解决办法,Lütke仍担忧大规模维护难题,Claude Code 团队称会跟进。

机器之心
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ
新闻资讯8

英伟达震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!

英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。

新智元
7

刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5

刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5,Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5。API平台已更新,价格和之前Pro预览版基本一致,但网友实测发现CoT表现不佳。

量子位
新闻资讯7

刚刚,Claude偷偷上线隐形水印,每个字都可全球追踪!

8月2日起,Claude生成文字将带隐形水印,触发原因是欧盟AI法案透明度要求。Anthropic设计了文本隐写加文件签章两层标记,覆盖五条产品线,全球生效,但水印存在四重局限,引发用户争议。

新智元