「Cyb5b」共找到 2489 篇相关文章
凌晨,Qwen又更新了,3090就能跑,3B激活媲美GPT-4o
Qwen凌晨更新,Qwen3 - 30B - A3B有新版本Qwen3 - 30B - A3B - Instruct - 2507。仅激活3B参数,实力媲美谷歌Gemini 2.5 - Flash和OpenAI的GPT - 4o,在多项测试中提升显著,已在魔搭社区等平台开源。
Claude Fable 5重新上线!GPT-5.6秒跟
Claude Fable 5重新上线,或为小范围灰度测试。此前因出口管制停产近两周。它能力强但烧Token,社区一直盼回归。同时,GPT - 5.6在Fable 5上线后秒跟,将分批发布。
14B打败671B!微软rStar2-Agent在数学推理上超过DeepSeek-R1
如今的大语言模型推理能力关键在于测试时扩展,但长思维链有局限。微软研究团队用主动式强化学习探索,成果 rStar2 - Agent 方法训练出 14B 的 rStar2 - Agent - 14B 模型,性能超 671B 的 DeepSeek - R1。
刚刚,GPT-5 横扫编程奥林匹克,5 小时打穿 12 题!人类最强队伍只能做出11道
2025年国际大学编程竞赛世界总决赛(ICPC)上,GPT - 5和OpenAI实验推理模型5小时解完12道题,超越人类最强队伍。Google DeepMind的Gemini 2.5 Deep Think获10/12。此成绩展示推理系统惊人进步。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
砸场GPT-5,马斯克:Grok 5 年底推出!
OpenAI举办GPT - 5发布会,现场状况百出,图表数据与柱状图不符,员工表现不佳。马斯克趁势放话,年底前推出Grok 5且会「碾压性地出色」,还引用数据挑衅,网友对此反应不一。
MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳
腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。
一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一
文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。
GPT-5.5好到不敢睡觉,奥特曼连夜写下五大宣言!
GPT-5.5代号「Spud」,在多项测试中表现出色,开发者实测反馈良好。奥特曼在GPT-5.5发布且口碑好时,写下AI五大原则,称AI要民主化、赋能等,还暗示政府需考虑新经济模式应对AI影响。
Claude Opus 5深夜发布,以一半价格逼近Fable 5。
周六凌晨Claude Opus 5全量上线,在所有Claude产品里可用。它有100万上下文,知识最新到2026年5月。跑分显示其在很多领域逼近Fable 5,价格仅为一半。它和Fable 5各有优势,还带来Claude Code使用的变化。