「中国大模型」共找到 9736 篇相关文章

产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
产品应用8

AI如何重塑大厂成熟业务?百度文库GenFlow打了个样

文章讲述百度文库借助AI从“资源下载站”变为“智能生产力平台”。其转型体现在产品定位重构、挖掘用户需求、跨业务协同。GenFlow2.0打通文库与网盘,提升体验、重塑边界,证明非核心业务也能价值重生。

乱翻书
算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
新闻资讯7

V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!

DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。

PaperAgent
7

记录下SGLang开发,优化,debug的技巧之大SKILL时代已来临

文章记录SGLang开发等技巧,介绍Agent在编程开发领域的强大能力,如完成多种工作、提升模型速度。还提及Agent流程优化方向,提醒警惕其偏差,指出人的价值转变,成为设计、把关和提炼者。

GiantPandaLLM
开源动态8

最强开源0.9B级OCR模型!本地Agent、知识库都有救了!

百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。

开源星探
开源动态7

两分钟Claude Code模型换成DeepSeek,立省17倍,缓存后爆省120倍

GitHub开源deepclaude,两分钟可将Claude Code模型换成DeepSeek V4 Pro,开销直降17倍。自带上下文缓存机制,重复对话成本降120倍。支持多后端选项,可丝滑切换,还能打破设备限制远程编程。

AIGC开放社区
新闻资讯7

OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark

OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。

AI寒武纪
推荐文章7

AI越强,企业越迷茫:顶尖CIO们的十大真实之问

阿里云CIO与40余家头部企业CXO深度碰撞,总结出《企业智变下的CIO集体之问》。报告指出企业AI落地困境,如数字人认知混沌、知识库建设难等,探讨十大经典问题,为企业提供思考方向。

InfoQ
新闻资讯7

突发!美国解除封锁,英伟达可向中国销售H20 AI芯片

CNBC消息,美国政府向英伟达保证授予销售许可,将恢复对中国销售H20 AI芯片。此前该芯片受出口管制。黄仁勋加大游说,与特朗普会面后美态度转变,他还宣布新GPU,英伟达财报表现强劲。

AIGC开放社区