通用语法」共找到 757 篇相关文章

算法论文8

Think in Games:做一个在王者荣耀中会玩和思考的Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。

深度学习自然语言处理
算法论文7

清华唐杰新作:大模型能打掼蛋吗?

清华、北邮等团队联合研究表明大模型能打掼蛋等8种棋牌。不同模型在不同棋牌表现有差异,如GPT - 4o综合佳,GLM4是“全能型选手”。研究还探讨学习方法、模型性能影响因素及游戏间相互作用等。

量子位
算法论文8

DeepMind 最新研究:智能体就是世界模型!

DeepMind研究科学家Jon Richens团队在ICML 2025发表论文,从第一性原理证明智能体就是世界模型,回答了AI界多年的根本问题,还带来多个有趣推论,引发AI社区热烈讨论。

AGI Hunt
推荐文章8

从 yield 到 await:Python 协程的进化史

文章按时间线与逻辑脉络,讲述 Python 协程从生成器到`async/await`的进化史,介绍各阶段特点、困境及解决方案,如`@wrappertask`的应用,还提及演进带来的启示。

阿里云开发者
算法论文8

清华新研究,Nature+Science双杀!

清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。

量子位
算法论文7

见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述

该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。

深度学习自然语言处理
产品应用7

分享10个你可能不知道的Claude Code隐藏命令。

作者分享10个Claude Code隐藏命令,如/btw可并行提问不污染上下文,/rewind能分别回退代码和对话等,还介绍快捷键,强调Claude Code更新快,建议关注更新动态。

数字生命卡兹克
新闻资讯8

Gemini证明数学新定理!全程没联网

Gemini内部数学版学霸模型FullProof全程不联网,帮数学家证明代数几何领域新定理,即0亏格映射到旗簇空间的motivic类等价结论。它埋下关键思路伏笔、独立给出反例,比Macaulay2更优。

量子位
新闻资讯7

OpenAI大变革!继续与微软等,以非营利模式冲击AGI

今天凌晨2点,OpenAI宣布继续由非营利组织控制,营利性实体转变为公共利益公司。此前转型营利性公司引发争议,此次调整是听取各界意见后做出,旨在让AI造福全人类。

AIGC开放社区
新闻资讯7

Show me《指环王》!卡帕西强推大模型评测新基准

大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。

量子位