鸿蒙元服务」共找到 1275 篇相关文章

产品应用8

腾讯混A13B用130亿参数达到千亿级效果,Flash Attention作者点赞

腾讯混A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。

量子位
开源动态8

「上下文学习」之后,腾讯混第二篇公开研究:精准定位RLVR训练崩溃的“罪魁祸首”Token

腾讯混团队新研究提出异常梯度定位器 GradLoc,可将全局梯度突刺定位到具体异常 token,降低 RLVR 训练观测与分析门槛,助力解决训练不稳定问题,让模型调优更科学。

机器之心
算法论文8

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务

现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。

机器之心
产品应用8

Qwen3.8-Max首发上线阿里千问AI平台,API服务与Token Plan同步开放

今日,阿里巴巴发布新一代基座大模型Qwen3.8,千问AI平台首发其Max版API服务与Token Plan。Qwen3.8参数量2.4万亿,性能居前列,推理快且能自主编程。API性价比高,平台还为Token Plan用户提供优惠。

阿里云开发者
产品应用8

首发限时免费两周!实测腾讯混Hy3:Agent能力飞升,日常主力毫无压力

腾讯混Hy3正式版发布,尺寸300B,在多领域表现亮眼,追平甚至超越大参数模型。作者用三个刁钻场景实测,Hy3在全栈开发、3D游戏开发、办公任务中表现出色,幻觉率低,达生产级标准。

AI寒武纪
算法论文8

腾讯混TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合

腾讯公开混TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。

AI前线
新闻资讯7

OpenAI开启“印钞机”模式?ChatGPT官宣引入广告,新增8美金/月Go版低价订阅服务

OpenAI宣布广告业务要来了,其低成本订阅服务ChatGPT Go将登陆美国及所有ChatGPT可用地区。未来几周将在美国免费版和Go版中测试广告,Pro、Business和Enterprise订阅方案无广告。还明确广告业务五大原则。

AI寒武纪
开源动态8

腾讯开源混世界模型1.1,视频秒变3D世界,单卡推理仅需1秒

腾讯发布并开源混世界模型1.1,是统一的端到端3D重建基座大模型。它支持从多视图或视频一键生成3D世界,单卡秒级推理完成高精度重建,性能达SOTA,还具多特性,打破技术壁垒。

量子位
开源动态8

腾讯混开源世界模型!2.0版本一键生成3D空间,游戏关卡随心造

4月16日,腾讯正式发布并开源混3D世界模型2.0(HY - World 2.0)。它是多模态模型,能理解多种输入,自动生成、重建和模拟3D世界,支持多格式3D资产导出,可与游戏工作流对接。

量子位
算法论文8

中山大学HCP Lab联合拓智慧提出高效世界模型DDP-WM,机器人规划效率提升9倍

中山大学人机物智能融合实验室联合拓智慧提出新型高效世界模型框架DDP - WM。它解耦动态预测,在提升推理速度同时,提高规划成功率,如Push - T任务规划速度提9倍、成功率从90%升至98%。

机器之心