「乐高模型设计」共找到 8473 篇相关文章
GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了
麻省理工学院推出全新自适应大模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为大模型自进化提供新路径。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。
硅谷一线创业者内部研讨:为什么只有 5%的 AI Agent 落地成功,他们做对了什么?
来自硅谷一线AI创业者数据显示,95%的AI Agent在生产环境部署失败,原因在于围绕模型搭建的脚手架不完善。文章基于研讨会内容,探讨AI Agent构建关键,如上下文工程、安全控制、记忆功能等,并指出待解决问题和未来方向。
YC最新总结顶尖的提示词应该怎么写?
提示工程在大模型时代愈发重要,其核心在于提示词设计。近日,YC在播客分享从与大模型创业公司学到的提示工程实践,涵盖核心原则、进阶技巧、企业级实践、创业者模式等内容。
解密 Cursor:一位深度用户的原理探析与实验验证
文章作者作为 Cursor 付费用户,通过实验分析其与大模型通信机制和设计原理。用 OpenAI 的`gpt - 4o`模型做实验,发现它是‘基模 + 若干工具’组合,也指出在真实项目因上下文不足表现不佳。
极客大神构建了LLM架构画廊,AI大神Karpathy点赞
极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy点赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。
一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"
研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。
Claude Opus 4.5 × Agent Skills:从第一性原理深入剖析
文章深入剖析Claude Opus 4.5与Agent Skills,介绍了Claude Opus 4.5发布,结合Agent Skills能让模型有专业级能力。还阐述Agent Skills高级设计模式、内部架构及执行生命周期,揭示其工作机制与优势。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
姚顺雨入职腾讯50天后,发布了首篇署名论文:CL-Bench
2月3日姚顺雨加入腾讯50天后发布首篇署名论文《CL-bench: A Benchmark for Context Learning》。该论文做了新的benchmark,测试显示前沿模型平均分仅17.2%,指出模型在上下文学习尤其是归纳能力上的短板。