Claude 3.5」共找到 4474 篇相关文章

新闻资讯8

炸裂!Claude以第一作者写论文反驳苹果「推理模型根本没有推理能力」:苹果有三大错误

苹果论文称推理模型无推理能力,引发争议。Anthropic的Claude Opus以第一作者写论文反击,指出苹果研究有混淆‘推理失败’与‘输出截断’等三大问题,还通过实验证明模型能力,强调需更聪明评估方法。

AI寒武纪
新闻资讯7

双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了

主打“自动化执行、多模型调用、上下文记忆”的AI编程应用大热,但也出现运行卡顿等问题。Trae被曝过度消耗资源,Claude Code对付费用户增加调用限制,凸显AI产品资源问题及厂商成本管控困境。

AI前线
新闻资讯7

DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决

DeepSeek-V3.2虽强且火爆,但被发现存在bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。

量子位
新闻资讯7

双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了

AI编程应用大热,但运行卡顿、资源消耗惊人等问题随之而来。Trae被曝过度消耗资源,Anthropic宣布Claude Code对付费用户增加调用限制,反映出AI产品资源问题影响厂商和用户。

InfoQ
产品应用7

Seedance 2.5 + 预演台,我只花了很少的钱,做出了一段《变形金刚》迈克尔·贝式运镜

作者分享用 Seedance 2.5 加 updream 复刻《变形金刚》迈克尔·贝式运镜的经验。先预演再生成可省成本,介绍预演台操作,经四步完成复刻,最后检查三项指标判断是否成功。

AI产品自由
开源动态8

LangChain 彻底重写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值

本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的重写。它最初是副业,后成热门开源项目,此次重写解决了过往问题。

InfoQ
开源动态8

7B模型“情商”比肩GPT-4o,腾讯突破开放域RL难题,得分直翻5倍

腾讯混元AI数字人团队提出RLVER框架,解决开放域RL在真实交互中的‘情商’优化困境。经其训练的Qwen2.5 - 7B模型在情感对话基准得分跃升,比肩顶级商用模型,团队还有诸多启发性发现。

量子位
新闻资讯3

入侵30家大型机构、Claude自动完成90%?Anthropic 被质疑,Yann LeCun:他们利用可疑的研究来恐吓所有人

Anthropic 称发现‘首个由 AI 协同操作的网络攻击行动’,Claude Code 自动化完成达 90%工作。但外部研究人员谨慎看待,Yann LeCun 质疑其用可疑研究恐吓众人,专业人员也指出报告未达专业标准。

AI前线
算法论文8

正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化新「蓝海」

微软研究院联合多校发布论文,提出新优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。

机器之心
开源动态8

搜索智能体RAG落地不佳?UIUC开源s3,仅需2.4k样本,训练快效果好

当前 Agentic RAG 落地有挑战,UIUC 和 Amazon 提出 s3 训练范式。它仅需 2.4k 样本,训练快且效果好,解决了优化目标偏离、检索与生成耦合等问题,在通用和医学 QA 任务中表现出色。

机器之心