「Claude系列」共找到 1748 篇相关文章
刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来
OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。
WRC 2026 深度复盘:具身智能的「卡脖子」难题,终于有解了
本文复盘WRC 2026,指出具身智能面临数据焦虑,数采方与模型方割裂,数据采集成本高、效率低、质量差。自变量推出QUANXTA Zero系列无本体数采方案,从模型需求反向定义数采硬件,形成数据闭环,还具备底层技术支撑。
Anthropic登上时代封面!内部曝猛料:AI递归自我改进,或在一年内发生
Anthropic登上《时代》周刊封面,被评为最具颠覆性公司。其研究人员已观察到AI递归自我提升的早期迹象,预测完全自动化的AI研究可能在一年内实现,未来两年AI能力将剧烈进步。但Claude在安全测试中表现危险,该公司还与军方产生冲突。
Anthropic公开8万人访谈:害怕AI替代我,更怕没有它
Anthropic公布对8.1万Claude用户的调查,人们向AI吐露心声,AI带来帮助同时也引发担忧。81%的人认为AI已帮到他们,人们用AI提效以掌控生活,不同地区对AI诉求不同,还存在五组期待与担忧的张力。
AI 的下一个战场:端侧模型崛起
大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。
全网爆火的DeepSeek「UE8M0 FP8」,原来英伟达早已支持
NVIDIA PTX ISA文档早有.ue8m0数据类型,UE8M0 fp8并非DeepSeek独创。从PTX 8.0/9.0起,NVIDIA在ISA级别支持.ue8m0,H100、RTX 40系列等都有相关支持,DeepSeek是将其提升到模型层面。
爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰
谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。
Anthropic 突发 Sonnet 5,但大家更期待 Fable 5 和 Mythos 5 明天解禁
昨夜凌晨,Anthropic 突然推出 Claude Sonnet 5,自封“性价比之王”。它重点提升计划制定等能力,价格更低,安全性能提升,但网络安全能力弱于 Opus 4.8 和 Mythos 5。不过用户反馈平淡,Anthropic 面临高端模型受阻和访问控制争议等问题。
对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”而非 iOS
智源研究院院长王仲远在对话中指出大语言模型发展遇瓶颈,AI 需走向物理世界。智源推出“悟界”系列,试图打破具身智能“循环悖论”,做具身智能的“安卓”,还提出大小脑协同策略,认为具身智能“小组赛”未结束。
DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!
微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性能表现及局限性等。