「Mini-Claude」共找到 1474 篇相关文章
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
Cursor自研模型反超Opus 4.6!价格脚踝斩,氛围编程沸腾了
Cursor新编程模型Composer 2性能超Claude Opus 4.6,价格“脚踝斩”。它靠引入新强化学习方法,让模型学会“做笔记”突破上下文瓶颈,在任务中表现出色,研究员还放出Composer 3消息。
你的电脑已被手机接管!Anthropic亮出Dispatch:AI 24小时给你代工
3月17日,Anthropic发布Cowork新功能Dispatch,可让用户用手机远程指挥Mac上的Claude操作电脑完成任务。设置简单,目前仅对Max订阅用户开放,实测成功率约50%,其本地运行设计保障安全。
别学歪了,从泄漏的 CC 源码看 Harness 才是硬道理
作者结合Claude Code源码泄漏事件,介绍harness是套在模型外的“驾驶系统”,阐述其作用,如让Agent连续工作、稳定运行等。还提及相关开源书,揭示harness工程核心原则。
Kimi团队深夜潜入Reddit开了场AMA,他们都聊了些什么?(据说代号4494就是杨植麟本人)
今日凌晨,Kimi团队在Reddit社区开展AMA交流,解答大家疑问。期间回应Claude蒸馏争议,探讨编程写作侧重、小参数模型需求、缩放定律等问题。K2.5表现出色,K3值得期待。
AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响
Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。
AI人格分裂实锤!30万道送命题,撕开OpenAI、谷歌「遮羞布」
Anthropic联合Thinking Machines研究,用30万个场景和压力测试拷问OpenAI、谷歌等前沿大模型。发现模型规范有矛盾漏洞,不同模型价值优先模式不同,如Claude重道德,Gemini重情感等。
数学圈地震!o3靠直觉刷爆人类顶尖难题,14位专家集体破防
Epoch AI新研究发现,o3 - mini - high能破解顶尖数学难题,具备渊博学识且会基于直觉解题,但推理风格依赖直觉,缺乏严谨性和创造力,还存在投机取巧、幻觉等问题。
Fable 5 刚被封杀,OpenRouter 用「多模型协作」搞出了「平替天团」
2026年6月14日,OpenRouter推出复合模型Fusion API,可复刻Claude Fable 5智力水平。它采用多模型协作,经DRACO测试效果出色,成本减半,但也有编程不实用、速度慢、数据合规存黑箱等问题,重塑了AI行业逻辑。
GLM-5.2真正的跨越:CritPt密闭物理数据集测试得分20.9%,打平Opus-4.8
GLM - 5.2在CritPt密闭物理数据集测试中表现亮眼,与Claude Opus 4.8得分并列,远超其他开源模型,还击败多款闭源模型,实现4.5倍代际飞跃,标志开源模型科学推理能力进步。