GPT架构」共找到 2741 篇相关文章

开源动态7

Claude Code完整技术栈都被扒出来了,Multi-Agent架构~

analysis_claude_code项目对Claude Code v1.0.33逆向工程分析,含混淆代码技术分析等。发现实时Steering机制、多Agent架构等,为AI agent系统设计实现提供技术参考,还介绍系统架构创新点。

PaperAgent
新闻资讯7

离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构

曾是OpenAI的「强化学习最大主义者」Jerry Tworek,与谷歌Gemini预训练负责人Rohan Anil,共同创办Core Automation。他们探讨当前AI路线问题,认为下一代架构要能持续学习,还计划打造自动化AI实验室。

机器之心
新闻资讯7

GPT-5数字母依然翻车!马库斯:泛化问题仍未解决,Scaling无法实现AGI

杜克大学教授让GPT - 5数blueberry里的b,结果GPT - 5多次答错。著名学者马库斯整理其各种bug,指出大模型泛化问题严重,认为Scaling无法实现AGI,转向神经符号AI才是途径。

量子位
新闻资讯7

OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark

OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。

AI寒武纪
产品应用7

Google Nano Banana 与 GPT-4o Image 1:哪款 AI 图像生成更好?

2025年8月26日,Nano Banana发布引关注,而GPT - 4o Image 1是主流常用图像生成器。文章从关键指标、生成速度对比二者,又用相同提示词在多种场景对比,分析各有优劣,适用场景不同。

MCP Server
新闻资讯7

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

奥特曼首晒GPT - 5实测,虽对话仅围绕电视剧推荐,但引发大量关注。除官方放料,还被曝重写编码规则,用上超级对齐团队“遗产”通用验证器,不过也有爆料称其研发遇困难。

量子位
新闻资讯8

从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”

2017年《Attention Is All You Need》提出Transformer架构,重塑AI版图。其作者“Transformer八子”中,Lukasz Kaiser加入OpenAI,参与GPT-4、GPT-5等研发。他10月将出席大会分享见解,曾预言多模态等趋势已渐成现实。

AI科技大本营
开源动态7

开源DeepSeek R1增强版:推理效率快200%,创新AoE架构

德国TNG公司开源DeepSeek R1增强版DeepSeek - TNG - R1T2 - Chimera,基于三大模型混合开发,采用创新AoE架构,推理效率比R1 - 0528快200%,成本大减,在主流测试中性能更好。还介绍了AoE架构构建子模型方法。

AIGC开放社区
新闻资讯7

GPT-5「降智」真相曝光:不是变笨,而是五个超级开关没激活

新智元报道,OpenAI最新提示工程指南揭秘调教GPT - 5的方法。通过调整自主探索倾向、推理深度等五个开关,可让GPT - 5从偶尔靠谱变全能,还介绍了元提示小技巧解锁其潜力。

新智元
推荐文章7

一文讲清三种AI应用系统的架构及及TOP威胁框架

文章从AI系统分类及架构出发,分析不同类型AI系统的威胁特征,并介绍现有的威胁分析框架。目前AI应用架构经历从GenAI到AI Agents,再到Agentic AI的演进,各方向独立发展,且威胁各有特点又有重合。

AI与安全