GLM - 4.6」共找到 2021 篇相关文章

新闻资讯7

ChatGPT负责人深度复盘,爆4o复活内幕!过快下线是失误,将迭代模型人格

8月14日,ChatGPT负责人Nick Turley深度复盘GPT-5发布「风波」,总结失误如过快下线GPT-4o、低估用户情感依恋等,还分享OpenAI产品设计哲学,强调持续迭代模型人格。

新智元
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
开源动态8

生图效果媲美GPT-4o,一键搞定各类视觉生成任务丨港科广&字节全新框架

港科大(广州)和字节联合推出开源框架ComfyMind,它是通用视觉生成框架,能统一处理主流视觉生成任务。其性能超现有开源方法,媲美GPT - 4o - Image,还介绍了架构、接口等及性能评估情况。

量子位
新闻资讯8

4位图灵奖得主布道,2大冠军机器人登台,“AI春晚”果然又高又硬

智源大会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。大会还发布“悟界”系列大模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。

量子位
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
开源动态8

神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡

神秘模型「牛来」真身曝光,是智谱刚开源的 GLM - 5.3 Flash,为 5 系列首个原生多模态模型。它尺寸小能力强、价格低,用国产卡,实测多模态和 Coding 能力出色,架构全新,开源后将模型、算力和生态结合。

量子位
7

DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

DeepSeek V4系列发布1个月,官方永久降价,开源社区的Reasonix项目将缓存命中率干到99.82%,能大幅降低成本。它专为DeepSeek打造,实现思路基于其缓存机制,安装使用简单。

量子位
产品应用7

全球首个龙虾模型 GLM-5-Turbo 发布:已经在用它帮我省几千块钱了

作者作为公众号编辑,排版耗时久费钱。他测试多款模型驱动龙虾排版均失败,换上智谱 GLM - 5 - Turbo 后成功,还能让其操作飞书润稿。该模型工具调用稳定,虽 API 涨价但性价比高,未来潜力大。

特工宇宙
开源动态8

2 天斩获 3.5K 标星!GitHub 惊现神器!一个二进制文件把 DeepSeek V4 搬进终端

GitHub上的DeepSeek TUI项目开源两天获3.5K Star,它把DeepSeek V4模型搬进终端成编码智能体,有原生RLM并行推理等亮点,提供多种安装方式、支持多提供商,适合终端开发者。

开源星探
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心