策略游戏自博弈」共找到 1214 篇相关文章

算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
新闻资讯7

马斯克脑机接口,靠意念玩游戏只是基操,下一代设备性能翻三倍

近日,马斯克转发帖子,Neuralink植入脑芯片患者能用意念玩游戏。全球21人参与其临床试验,患者借此控制设备,生活改变。下一代设备性能将提升三倍,2026年或推出,还在开发复明设备。

机器之心
产品应用7

适配鸿蒙操作系统!!腾讯游戏直播SDK基于Kuikly三端一码开发实践

随着鸿蒙Next发布,腾讯推进游戏电竞直播SDK鸿蒙适配。基于Kuikly框架实现业务代码100%跨三端、跨多App复用,节省超50%人力。介绍适配工作、目标、方案,还提及组件Kuikly化等内容。

腾讯技术工程
开源动态7

又上Trending,这个项目赋予AI灵性,可以和你一起玩游戏看电视!

项目 AIRI 可让用户轻松拥有数字生命。与其他项目不同,它支持多种 Web 技术,能在现代浏览器和设备运行,还能玩游戏、看视频。目前已完成部分基础功能,支持众多 LLM API 服务,还衍生出多个子项目。

GitHubStore
产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 大模型推理加速架构

网易游戏打造 Tmax AI 机器学习平台,但大模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯7

Cloudflare 推出 Agent Tracing:支持截断限制,不同框架的 Payload 默认记录策略存在差异

Cloudflare推出Agent Tracing,可提供统一Dashboard查看已部署Agent会话。该功能在现有Workers Tracing基础上增加Agent级别的Span,有收费时间表。不同框架Payload默认记录策略有差异,Trace有截断限制。

InfoQ
新闻资讯7

00后黑客落网!曾运营大型僵尸网络,频繁攻击腾讯游戏、DeepSeek、X平台

活跃多年的高危DDoS僵尸网络‘RapperBot’被取缔,主谋22岁美国男子Ethan Faulds被捕。该网络曾攻击腾讯游戏、DeepSeek、X平台等。文中介绍其家族情况、盈利模式,还提及腾讯宙斯盾系统及防护建议。

腾讯技术工程
推荐文章8

一文全解析:AI 智能体 8 种常见的记忆(Memory)策略与技术实现

本文剖析8种常见AI记忆方案,如全量记忆、滑动窗口等,分析其原理、特点和适用场景,还给出模拟代码助理解。不同策略各有优劣,适用不同对话场景,能为项目评估、选择和实现Memory方案提供参考。

AI大模型应用实践
产品应用8

中国团队一夜封神,AI出海「全球第一」!曾靠游戏狂赚10亿美金

在大模型竞争激烈的当下,中国出海团队SeaArt(海艺)用2.5年超越Midjourney等,成全球访问量第一的AI内容创作社区。它打造AI原生内容生态,SeaVerse开启全模态时代,还靠洞察用户、游戏基因等优势制胜。

新智元
产品应用8

谷歌Genie3全网玩疯!画质飞跃720P,网友造出西幻RPG游戏

谷歌世界模型Genie3发布仅7个多月就有巨大进化,画质达720P,体验时间拉长,世界类型丰富。它玩法多样,能体验极限运动、亲近自然、穿越时空等,网友还用它造西幻RPG游戏

量子位