类LLM机制」共找到 1976 篇相关文章

产品应用8

给 OpenClaw 再加一道安全护栏

为保障智能体安全,开发了SKILL,覆盖安装前到运行中的全生命周期。安装前进行九风险检查,运行时有guard机制,从六个方面看风险,设四层风险分级和输入信任等级,目标是让智能体更可控。

深度学习自然语言处理
推荐文章8

超长 Agent 任务如何不崩盘:Claude Code 上下文管理机制深度拆解。

文章深度拆解Claude Code上下文管理机制,包括七上下文、预算与告警、加载、卸载机制等。指出其是分层缓存与多级预算管理系统,还为长任务Agent开发者提供了管理启示。

AI大模型应用实践
新闻资讯8

Andrew Karpathy最新访谈:RL很糟糕、人学习和教育、智能和文化的演变、AGI还要十年,将带来2%的GDP增长

Dwarkesh Patel 播客对 Andrej Karpathy 进行深度访谈。他认为 AGI 还需十年,目前算法有缺陷;强化学习虽有问题但必要;分析了 LLM 局限,探讨人学习机制、AGI 经济影响等多方面内容。

AGI Hunt
算法论文8

提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25

上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。

量子位
算法论文8

字节跳动李航博士新作:AI智能体的通用框架

字节跳动李航博士在JCST发表观点论文,提出涵盖软件和硬件智能体的通用框架。该框架以完成任务为目标,依赖LLM,用强化学习构建。文章还探讨了与大脑机制关联、未来研究方向等。

机器之心
新闻资讯7

线性注意力回归!Kimi新模型引爆,MiniMax却悄悄换回传统架构

LLM领域线性注意力机制正在回归,工程实践主要由国产模型推进。早期线性注意力因牺牲精度未获主流认可,今年下半年多个国产模型采用其变体,MiniMax却又换回传统架构,Kimi新模型带来新解法。

AI寒武纪
推荐文章7

深度长文解读 “世界模型” :在虚构与真实交接之处凝视未来

本文深入解读“世界模型”,虽无明确定义,但从目的出发分为表征和生成两。前者含生物大脑、视觉和语言中心预测;后者有基于规则模拟和数据驱动生成。还探讨LLM是否为世界模型,指出各模型相辅相成。

AI科技评论
产品应用8

RecGPT-阿里的LLM推荐系统落地方案

文章介绍阿里RecGPT推荐系统落地方案,包括召回和推荐可解释性两方向。召回采用三塔结构,通过挖掘用户兴趣生成商品标签提升召回多样性。还提及行为序列压缩、推荐归因等,以及大模型微调和评估方法。

王喆的AI笔记
算法论文8

ICLR 2025 Oral | LLM也有从众心理!

浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。

深度学习自然语言处理
新闻资讯8

Open Responses 规范实现智能体式 LLM 工作流的统一

OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。

InfoQ