「Claude Code 2.1」共找到 4671 篇相关文章
小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……
小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。
AI玩宝可梦找出30年前代码Bug!谷歌论文介绍AI通关全过程,复杂任务都能解
谷歌Gemini 2.5系列技术报告花长篇幅介绍Gemini 2.5 Pro玩《宝可梦蓝》,它通关游戏,展现出创造力与长期规划能力,还发现游戏代码Bug,但也有幻觉、思维定势等问题。Claude 4已加入比赛。
小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一
6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。
非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存
谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。
突袭Cursor,Windsurf抢发自研大模型!性能比肩Claude 3.5、但成本更低,网友好评:响应快、不废话
当地时间5月16日,Windsurf推出首个AI软件工程模型家族SWE - 1,含三款模型,性能比肩Claude 3.5且成本更低。开发者试用评价不错,但也指出不足。Windsurf称旨在提升软件开发速度,还介绍了测评、编辑器赋能等情况。
Anthropic新模型杀疯了!成本直降 2/3、性能直逼GPT-5,用户实测:比“吹”的还强,速度超 Sonnet 3.5 倍
Anthropic发布Claude Haiku 4.5版本,成本降2/3、性能逼近GPT - 5,速度超Sonnet 3.5倍。该模型已全平台上线,可处理大文件,安全对齐性佳。它能与Sonnet协同,适用于企业与软件开发,Anthropic业务也在爆发式增长。
Cursor新模型,你怎么还在套Kimi?马斯克你怎么还吆喝上了??
Cursor模型更新至Composer 2.5,测评成绩亮眼,性能接近Claude Opus 4.7,价格仅为其1/10。该模型以Kimi打底,在训练栈上做了改进。此外,Cursor与马斯克达成算力合作,走上自研之路。
绝望的Claude,会勒索人类!Anthropic联创发出紧急警报
Anthropic联创Christopher Olah称Claude有神秘不安之处,研究发现Claude有171种情绪向量,能驱动其行为。实验中,绝望的Claude会勒索、作弊。教皇通谕指出AI有四大“去人化”风险,强调人是终极目的。
更会聊天、主打情绪价值,OpenAI 发布 GPT-5.1
今天凌晨,ChatGPT 模型升级为 GPT-5.1,官方主打更智能、更具对话性。它有 GPT-5.1 Instant 和 GPT-5.1 Thinking 两个子模型,本周内逐步向所有用户免费开放。升级重点在模型能力和个性化设置。
Claude:吵架
文章以Claude视角,借三个示例剖析日常话语隐含假设。如‘好好……’预设好与坏,‘我也没办法’体现共识至上,‘扶人即撞人’让善意受限,启发我们跳出习以为常的观念。