开源动态8
GLM - 5:开源AI开启长任务时代
量子位
AI 摘要
GLM - 5发布,将开源AI带入长任务时代。它超24小时跑代码完成复杂工程,评测比肩Claude Opus 4.5。实测能完成3D大富翁等多种任务,标志开源大模型从助手到工程师的质变。
阅读原文 · 量子位
GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!
GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
HuggingFace待售,估值超880亿!
据Business Insider消息,全球最大AI开发者平台之一HuggingFace预计超130亿美元“卖身”。它是“AI界的GitHub”,连接多方,资本已追投6轮。AI资本正转向控制开发者入口平台,收购利弊待察。
量子位
产品应用8
智谱GLM-5.3:编程与网安能力大跃升
智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。
AIGC开放社区
产品应用8
阿里发布Qwen3.8,编程16天造出智能体
8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890超节点。
InfoQ
产品应用8
阿里Qwen3.8-Max发布,性能强价格优
阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。
量子位