「拟像概念」共找到 887 篇相关文章
一场「狼人杀」,考倒了一堆大模型
南开大学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿大模型测试。多数模型停留在表层模仿,仅少数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。
快速理解热门LLM大语言模型
本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍大模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并对AI未来发展作出假想。
AI是「天才」还是「话术大师」?Anthropic颠覆性实验,终揭答案!
Anthropic新研究证实Claude模型有一定内省意识,能控制自身内部状态。用「概念注入」实验,Claude Opus 4和4.1表现最佳。不过该能力不可靠、局限大,未来进化情况待察。
LangChain提出Agent工程化的新分层(Agent harness)
LangChain获新融资后重新定位为Agent基础设施提供商,将Agent开发分三层:Framework、Runtime、Harness。Vtrivedy提出Agent Harness概念,强调构建关键是“个性化定制基座”。Agent开发工程化成熟度在提升。
AI大厂系统提示词泄露:2.7万token里,藏着最好的提示工程课
GitHub上`system_prompts_leaks`仓库扒出Claude、GPT等AI系统提示词。这些提示词像事故档案,规则具体,其结构排序暴露优先级。普通使用者可借鉴,提升对AI提要求的质量。
AI Infra入门干货总结:大模型是如何高效推理的
作者深入研读vLLM源码,以Llama 3为例,聚焦Decoder-Only架构LLM,介绍推理各环节及张量维度变化,讲解连续批处理和Paged Attention概念,还阐述推理流程、采样策略等,最后总结相关拓展内容。
3D-AIGC 存储架构演进:从 NFS、Gluster 到 JuiceFS
光影焕像在 3D-AIGC 存储上,因三维模型数据量大、格式多,对存储要求高。经探索,从 NFS、GlusterFS 到最终选 JuiceFS,搭建统一存储平台,管理上亿文件,提升处理速度,简化运维。
今天,Claude入职了!
Anthropic官宣Claude Tag,这是团队协作用Claude的全新方式,像“AI同事”般出现在Slack会话栏,响应主动,完成65%代码编写。它是Claude Code升级版,与前两代AI交互方式不同,Anthropic已离不开它。
阿里开源 Vivid-VR!带来逼真连贯的视频修复
阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。
新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型
Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。