「Claude模型」共找到 8548 篇相关文章
DeepSeek开源的不仅仅是个新OCR模型。。。
DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。
Claude会「做梦」了,梦里还在卷
Anthropic旗下Claude Managed Agents上线新功能Dreaming,可让AI在工作间隙“睡觉”反思,清理记忆、总结规律、自我升级。此外,还有Outcomes、多智能体编排功能进入公开测试,能让AI独立完成复杂工作。
Claude写80%代码,Anthropic工程师却越来越孤独
Anthropic工程负责人Fiona Fung带领团队用Claude Code使人均代码量翻8倍,但工程师交流减少,孤独感渐生。此外,还存在上下文切换、心流体验变淡、工作意义减弱等问题,工程师职业边界也在变模糊。
SpAItial发布超逼真3D空间基础模型
德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在多领域有革新可能,虽有竞争,但未来有望推动AI三维突破。
刚刚,Claude 推出记忆功能,比ChatGPT 好用
Anthropic为Claude推出引用过往对话新功能,向部分用户开放,其他用户也将很快获得。它能搜索和引用历史对话,与ChatGPT记忆功能不同,是按需检索,检索原始内容,还能隔离工作与个人内容。
AI写爆款博客火出圈,主笔竟是Claude!
Anthropic为Claude开博客展示写作能力,内容经团队把关。AI写内容已不新鲜,但多有翻车。普华永道研究称AI提升员工创效,重塑企业运营逻辑。多公司推行AI战略,不过学生用AI作弊引担忧。
幻觉终结者,PoG给大模型“打补丁”
传统检索方式易给大语言模型带入噪声,知识图谱虽能提供可靠知识,但处理多跳和多实体问题有局限。Paths-over-Graph(PoG)方法通过多跳路径探索、路径剪枝等提高LLMs在复杂任务中的表现,减少幻觉。
The Batch: 907 | 小而高效模型的“制作”方法
Mistral AI发布Ministral 3系列模型权重,结合剪枝与蒸馏技术,用级联蒸馏法构建。该系列参数规模有140亿、80亿和30亿,在部分测试中表现佳,训练成本低于传统方式。
构建 Claude Code 的经验:我们如何使用 Skills
本文来自Anthropic内部团队,总结构建Claude Code使用Skills的经验。介绍Skills类型,如库与API参考、产品验证等;给出编写技巧,涵盖避免说废话、建踩坑点章节等;还提及分发、管理及衡量效果的方法。
一篇大模型Agentic框架到应用最新综述
这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。