「游戏理解模型」共找到 8147 篇相关文章
GPT-5.1发布当天,文心5.0杀回来了
2025百度世界大会发布文心5.0,这一2.4万亿参数的原生全模态模型,训练之初融合多模态数据,支持联合输入输出。同日OpenAI推出GPT - 5.1,文心5.0在多方面表现出色,如情绪安抚更贴心、多模态理解能力强等。
图灵奖得主Hinton国内首次现身演讲:AI超越人类后,我们该怎么做
在世界人工智能大会WAIC上,图灵奖得主杰弗里・辛顿发表演讲,围绕AI历史、未来等展开。他认为大语言模型与人类理解语言方式相似,数字智能知识分享效率远超人类,还提议构建网络让AI向善。
警钟敲响!Hinton 最新万字演讲:怒怼乔姆斯基、定义“不朽计算”、揭示人类唯一生路
Hinton在演讲中提出“凡人计算”概念,指出生物智能会随肉体消亡,而AI软件与硬件解耦可“不朽”,还怒怼乔姆斯基,认为大语言模型理解语言方式与人类相似,且数字计算在知识共享上远超生物计算。
CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍
随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。
WAIC现场最“聪明”展台!AI眼睛耳朵能力全打开了
WAIC现场,声网展台被观众挤爆,其新奇“AI玩具”都能与玩家流畅对话。声网对话式AI引擎全新升级,新增选择性注意力锁定、视觉理解能力,能与主流数字人方案集成,还可接入大模型,价格低。它已在多领域落地。
顶模 Fable 5.1发布,到底强了多少?
昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。
480P的元宇宙入口:Midjourney不是在做视频,是在造"任意门"
Midjourney发布首个视频模型Video V1,它只能图生视频,操作便捷。虽分辨率仅480P,但采样率高。生成成本低,会员就能用。其美学表现好、生成速度快,不过在提示词理解等方面较弱。该公司有独特愿景。
上下文工程如何重塑智能体的“思考方式”?
文章指出在大模型时代,智能体能否理解上下文是关键。介绍了上下文工程的魔力、从提示词到上下文工程的演进,分析了上下文工程不等同于上下文的原因及常见失败类型,还给出编排设计和常见策略,最后提及用RAGFlow构建私有知识问答应用。
小美Agent:当龙猫遇到美团外卖的灾难现场
作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。
Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识
Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归时代。