Claude Mythos 5.1」共找到 4215 篇相关文章

算法论文8

10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步

上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。

量子位
产品应用7

Tailwind CSS 的核心设计师彻底抛弃 Figma,把Claude Code 变为主力设计工具

Tailwind CSS 核心设计师 Steve Schoger 用 Claude Code 做设计一个月,体验惊艳。他复盘了用其构建营销网站过程,还总结出设计细节处理方法,此外他正参与开发 UI.sh 工具。

AI寒武纪
开源动态8

杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源

杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。

AIGC开放社区
新闻资讯7

「一只手有几根手指」,你的GPT-5答对了吗?

CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。

机器之心
新闻资讯7

GPT-5破解世纪难题,竟是上网抄来的!哈萨比斯:太尴尬了

OpenAI团队狂吹GPT-5破解十道Erdos难题,结果是查文献给答案。谷歌DeepMind CEO哈萨比斯称尴尬,图灵奖得主嘲讽。开发者认为AI科研成果说法需谨慎,同行评审很必要。

新智元
开源动态8

单机H200最快DeepSeek V3和R1推理系统优化秘籍

作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。

GiantPandaLLM
新闻资讯7

陶哲轩亲测Claude跑崩电脑,全靠这份保姆级指令清单翻盘

全球顶尖数学家陶哲轩实测Claude Code,首次完全放权致电脑崩溃。后拆分任务、给出「保姆级」指令,约半小时完成证明。他强调人类应保持「人类在环」,拒绝过度依赖AI。

新智元
新闻资讯7

刚刚,DeepSeek最新发文!V3/R1训练细节全公开,信息量巨大

网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。

新智元
开源动态8

刚刚,美团开源 SOTA 推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking

美团宣布开源高效推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking,是国内首个结合多种推理能力的大语言模型。它采用新方法提升性能,已在多平台开源,API 平台免费开放,还兼容主流 API 格式。

AGI Hunt
推荐文章8

Cursor要凉?我扒出33个隐藏技巧,把Claude Code调教成完全体!

作者分享Claude Code实用技巧,指出其默认状态有问题,如犯低级错误、无回滚功能。介绍基础设置、项目规则、用Hooks实现自动化等内容,能大幅提升其使用体验和生产力。

探索AGI