「模型参数量」共找到 8281 篇相关文章
Karpathy教你值回ChatGPT 200刀「票价」,初创工程师揭秘ChatGPT最核心能力
AI大神Andrej Karpathy用一张图教你选ChatGPT模型,给出使用指南,如简单问题用4o,困难问题用o3等。初创工程师Eric Hayes揭秘其背后复杂记忆系统,含保存记忆、聊天历史等,提升了用户体验。
超越 GoF:现代 AI 系统实用设计模式
文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。
英伟达重返中国!6月大量生产特供AI芯片,价格暴降40%
路透社消息,英伟达为突破美出口限制,将为中国推特供AI芯片,6月量产,价格降40%。该芯片基于RTX Pro 6000D,简化设计以控成本和符合管制。虽计算力低,但CUDA生态有优势。
MCP客户端调用看这一篇就够了(Java版)
文章介绍MCP客户端调用方法,先阐述没MCP时的痛点,再讲大模型调用MCP的姿势,包括Spring - AI和Spring - AI - Alibaba框架的使用,还介绍原生SDK调用方式,记录踩坑问题,探讨两种技术路线的选型。
9座新厂之外:台积电现存26 个Fab厂概况一览
台积电作为全球晶圆代工龙头,扩建步伐加快,今年将新建9座厂。本文盘点其现存26座晶圆厂区,涵盖6英寸、8英寸、12英寸晶圆厂及后端封测厂,介绍各厂位置、概况和最新情况。
Anthropic首次启动员工股票回购,估值615亿美元
Theinformation消息,大模型平台Anthropic推出首个员工股票回购计划,面向工作至少两年的现任和前任员工,最多可售20%股权,每股56.09美元,公司估值615亿美元。此计划预计月底完成,方式独特,优势明显。
对话Memories.ai沈俊潇:用视觉记忆驱动物理AI自进化
DeepTech专访前Meta研究员、Memories.ai创始人沈俊潇,介绍公司聚焦视觉记忆领域,以视觉记忆驱动物理AI自进化,解决物理AI数据标注痛点,已获融资并与高通、英伟达合作,形成清晰的商业数据飞轮。
GPT-6 Astra全面解析 - “欢迎来到AGI时代。”
GPT - 6 Astra在全球AI大宕机后正式亮相,是全球最智能且最对齐的模型。它有诸多新特性,如操作电脑能力强、ARC - AGI - 3跑分高、审美提升等,但也带来思维链难监控等新问题。
新版GPT Image 2.5已经能伪造GPT-6发布会了
GPT-6还未发布,新版生图模型GPT Image 2.5就能伪造其发布会。它升级幅度大,测试显示能伪造奥特曼全员信等,在LMArena测试有生成快、图像逼真等特点,生图或成GPT-6主打功能。
Claude 5.1双旗舰突然发布:跑分屠榜,反蒸馏,科研能力大幅跃升,缓存费用暴降75%
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。