「LLM聊天机器人」共找到 1985 篇相关文章
如何让LLM的输出更有创造性和随机性?
文章指出让大模型生成随机创造性内容困难,介绍了调整温度和top_k参数等提升LLM创造性和随机性的方法,还提到min_p参数影响及外部引入随机性思路,不过LLM本质有局限,多智能体或可缓解。
LeCun团队揭示LLM语义压缩本质:极致统计压缩牺牲细节
图灵奖得主LeCun团队提出全新信息论框架,对比人类与LLM语义压缩策略。通过构建人类概念分类基准、选30+LLMs,发现LLM虽有语义组织能力,但难处理细粒度差异,侧重统计压缩,人类更重细节语境。
LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力
来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。
比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗
英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。
这是我见过最全的免费 LLM API 指南,正规合法、开箱即用!
个人开发者在使用LLM API时面临成本高、资源杂乱、稳定性差等问题。Github上项目`free-llm-api-resources`整合全网正规免费资源,排除不合规服务,介绍主流模型、限制说明等,值得收藏。
英伟达让机器人「做梦学习」,靠梦境实现真·从0泛化
英伟达推出DreamGen项目,让机器人‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器人学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。
RSS 2025|从说明书学习复杂机器人操作任务:NUS邵林团队提出全新机器人装配技能学习框架Manual2Skill
新加坡国立大学邵林团队提出 Manual2Skill 框架,利用 VLMs 将说明书视觉指令转化为机器人装配技能,含层级化装配图生成、分步骤位姿估计、动作生成与执行三阶段,实验验证其在多场景的有效性。
OpenClaw机器人引爆天网!首次拥有世界记忆,天网在GitHub「开源」了
全球开源机器人圈被引爆,装载OpenClaw的宇树人形机器人开始理解时空,拥有“世界记忆”能力。这是具身智能里程碑式突破,成果开源且硬件无关。网友看法不一,开发者回应质疑。
Andrej Karpathy:做个好人,未来的 LLM 正在看着你
Andrej Karpathy 12 月 10 号写 blog,用现在视角为十年前 Hacker News 帖子自动打分,开源代码。他近期多篇文章探讨 LLM 相关,如可验证性、智能空间对比等,还启动 Eureka Labs。他认为未来 LLM 会审视当下行为。
2篇最新152页论文,RL+LLM被彻底讲透了!
今天分享2篇2025最新RL×LLM的技术综述,分别聚焦“RL在LLM全生命周期的打法”和“RL如何炼成大推理模型”,梳理玩法、组件、算法演进等内容,还给出开源模型、数据等盘点。