「策略游戏自博弈」共找到 1216 篇相关文章
双管齐下:联邦学习防投毒攻击与梯度泄露,华南理工深北莫研究成果登上TMC与IoT
随着联邦学习在物联网系统广泛应用,数据隐私保护成难题。华南理工大学与深圳北理莫斯科大学合作,提出FedMSBA和FedMAR两种防御方法,分别解决参与方梯度泄露和服务器受攻击问题,在多方面实现突破。
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构,也能媲美纯视觉模型的3D理解能力。它通过视觉提示等策略,解锁VLM多任务处理潜力,为自动驾驶等领域带来前景。
Cloudflare 增强robots协议:对“AI白嫖”说不
互联网面临开放内容被利用或封闭内容失读者的困境,AI加剧此局面。Cloudflare持近20%网站流量,先推抓取付费策略,又推“内容信号政策”,升级robots.txt,限制AI训练使用内容。
“你的Agent,我一周末就能做出来!” AI时代的护城河:Cursor 卷每日迭代速度,DeepSeek 用技术撕大厂规模优势
文章围绕AI时代创业的“护城河”展开,介绍YC播客讨论内容,指出因ChatGPT易复制,创业者需思考持久商业模式。还列举Cursor、DeepSeek等案例,阐述速度、流程之力等多种构建护城河的方式。
腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型
腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。
“别再碰我代码!”明星AI工具成瘟神,用户怒斥:一周七千块,修不好bug还删我关键文件!
AI编程服务提供商Replit推出新一代AI编程助手Agent 3,CEO称其为软件“自动驾驶时刻”。但用户反馈它修不好bug还删关键文件,成本也高,Replit回应强调“模型栖息地”和“事务性”机制重要性。
英伟达推出通用深度研究系统,可接入任何LLM,支持个人定制
英伟达推出通用深度研究(UDR)系统,支持个人定制,可接入任何大语言模型。它能解决现有深度研究智能体的局限性,有诸多创新特性,但目前还在原型阶段,存在一定局限性。
NVIDIA技术沙龙《强化学习流水线优化:性能分析与 Rollout加速》演讲笔记
该演讲笔记围绕强化学习流水线优化,强调用Nsight Systems做性能分析,介绍在Ray Actor添加参数及解读文件方法。给出训练/生成参数优化技巧,如Actor训练和Rollout优化,还以Qwen 2.5 7B等模型为例总结参数调优经验。
ChatGPT 已经是新一代分发平台,创业公司该考虑怎么抓住增长红利了
文章指出ChatGPT已成新一代分发平台,创业公司应抓住增长红利。介绍了分发平台“开放 - 关闭”周期,分析ChatGPT最可能成最大消费平台,还给出创业公司选择平台标准及企业AI转型建议。
GPT-5通关《宝可梦水晶》创纪录!9517步击败赤爷,效率碾压o3三倍!
GPT-5通关《宝可梦水晶》创纪录,仅9517步击败赤爷,步数为o3的三分之一。它在主线任务效率也远超o3,如收集徽章、对战四天王等。其优势在于幻觉少、空间推理和目标规划能力强。