通用大模型」共找到 9368 篇相关文章

开源动态8

腾讯开源三具身基座模型,首席科学家张正友详解“三层脑”如何破解机器人反应慢

WAIC 2026 期间,腾讯开源三款具身基座模型。首席科学家张正友称此前用 OpenClaW 调度机器人效果差,后设计 TairosAgent 框架。腾讯将具身智能拆成三层,配合具身智能体和框架构成完整矩阵,还解决语言信息不足等问题,并在工业和养老场景测试。

InfoQ
新闻资讯7

人民想念DeepSeek

文章探讨AI时代Token相关问题。指出其消耗、价格贵,存储价格上涨使Token降价缺杠杆,虽模型能力提升、MFU优化可降本,但传导到C端取决于商业考量。还回顾模型价格战,介绍本地部署及芯片创新方案。

芯师爷
产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的社会实验

YuLan-OneSim是语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
开源动态8

Karpathy强推,厂抢着「复古」命令行,Star数全都上千了

飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。

机器之心
算法论文8

港科提出新算法革新模型推理范式:随机策略估值竟成LLM数学推理「神操作」

香港科技学联合团队提出 ROVER 算法,跳过传统强化学习推理的策略迭代循环。它在多项数学推理基准上超越现有方法,在高难度任务中幅提高 pass@1 和 pass@256,且提升推理多样性,更轻量。

机器之心
产品应用8

最高提效8倍!腾讯游戏发布专业游戏AI模型,美术师做动画不用辣么“肝”了

在Devcom开发者会上,AI成焦点。腾讯游戏发布游戏创作AI全链路解决方案VISVISE,含动画制作等四管线,能辅助美术完成重复工作。如MotionBlink可自动补帧,GoSkinning已在多游戏应用,提升了制作效率。

量子位
算法论文8

0.01%参数定生死!苹果揭秘LLM「超级权重」,删掉就会胡说八道

苹果研究人员发现模型中极少量的「超级权重」,即便占比仅0.01%,对模型能力影响巨。这一发现为模型「科学瘦身」提供思路,还提出定位方法,助力模型量化和未来研究。

新智元
开源动态8

媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型

阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。

AIGC开放社区
开源动态8

开源AI引爆热潮!GOSIM AI Paris 2025首日直击:80+位技术咖聊模型、拼算力、秀落地

5月6日,GOSIM AI Paris 2025会在法国巴黎启幕,80余位技术专家与学者参会。GOSIM联合创始人认为开源AI已追上闭源,AGI或由多模型组成网络。会设四分论坛解析开源AI,还有特色单元,明日将迎PyTorch Day。

AI科技大本营
算法论文8

8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp

模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。

机器之心