「Claude 3.5/3.7 Sonnet」共找到 4750 篇相关文章
Open AI 新模型在 IMO 2025 上获得金牌!
OpenAI新模型在2025年国际数学奥林匹克(IMO)中达金牌水平,测试时不借助工具、不连互联网,且不太可能存在数据污染。该模型解决6题中的5题,非GPT - 5,近期也不发布。
爆火!几天狂揽5万星,这个神器让AI一次砍掉54%屎山代码
最近开源项目Ponytail爆火,几天揽5万星。它将老程序员‘偷懒智慧’系统化喂给AI,让AI编码代理思考,使代码量直降54%,最高砍到94%,成本和时间同步下降,还保持100%安全。
狂砸百亿美元后,仅5%企业成功落地AI,他们做对了什么?
企业在生成式AI领域投入数百亿美元,但95%的机构未获可衡量商业回报,此为「GenAI鸿沟」。原因包括工具缺乏学习能力、预算分配失衡等。少数成功企业聚焦高价值用例,选易部署工具,与供应商深度合作。
Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力
上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。
斯坦福7B智能体全面超越GPT-4o,推理流登顶HF
传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。
时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8
在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。
只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%
南加州大学团队基于LoRA的强化学习训练1.5B推理模型,在AIME 24测试上性能提升超20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。
Anthropic CEO:1 到 5 年内,50% 的白领岗位将被 AI 取代
Anthropic CEO Dario Amodei 在采访中直言,1 到 5 年内金融、咨询等领域大量基层白领岗位将被 AI 取代。他认为 AI 进步快,虽有潜力治病供能,但也会致岗位消失,还提出教育和政府介入应对之策。
732M模型超越7B!机器人操控新范式:从视频中「悟」物理
机器人操控有「数据困境」,传统方法需大量人工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。
Skills vs MCP,谁才是「大模型的 HTTP 时刻」?
近期,Anthropic新推Claude Skills获好评,而MCP协议一周年却很寂静。文章探讨MCP定位、适用边界及潜在价值,分析其与Claude Skills的关系,指出MCP生态现状及适用业务场景。