「GLM4.5」共找到 2985 篇相关文章
Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞
沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在长时程智能体等方面有短板。
18岁天才少年,登上Nature封面!
DeepSeek-R1荣登Nature封面,成史上首个经严格同行评议大模型。18岁天才少年涂津豪以实习生身份参与,其从高中生到Nature作者的经历堪称传奇。他还改造Claude 3.5,开源项目获15k多星,还对AGI发表思考。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行。模型推理快、性价比高,在多领域表现出色,亮点是Agent和长文能力,已在腾讯多业务应用。
单卡可跑18万原子!分子模拟的“规模焦虑”该终结了
至知创新研究院UBio团队发布的UBio-MolFM v1.5,是可进行分子动力学模拟的机器学习原子间势函数。它在精度和规模上有提升,实测中表现优于经典力场,架构、数据和训练都有创新,误差降45%,速度提8倍,现已开源。
利润腰斩也要卷AI!小米模型永久降价99%,雷军还要再砸600亿
今日小米宣布 MiMo-V2.5 系列 API 永久降价,最高降 99%,Token 额度提升。虽 2026 年 Q1 财报显示利润腰斩、营收下滑,雷军仍称今年 AI 投 160 亿,未来三年投 600 亿。此前 DeepSeek 也已降价,中国大模型在 OpenRouter 表现亮眼。
小美Agent:当龙猫遇到美团外卖的灾难现场
作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。
不可思议!400B大模型在iPhone上跑起来了
一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。
为什么林俊旸会离职? | 甲子光年
3月4日凌晨,阿里Qwen团队技术负责人林俊旸宣布离职,同一天Qwen后训练负责人郁博文也正式离职。阿里刚开源Qwen 3.5小尺寸模型获马斯克点赞,此时核心团队出走引发关注。林俊旸离职或因团队分拆、管理范围缩小及“开源”与“闭源”的矛盾。
腾讯披露元宝已是TOP3应用
2025腾讯全球数字生态大会信息量大。腾讯元宝日活冲前三,混元3D建模精度提升3倍。C端产品逐步落地B端,如腾讯云CodeBuddy等。腾讯云还将带成熟生态出海,投资1.5亿美元在沙特建数据中心。
硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了
旧金山AI技术大会上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。