「30亿参数模型」共找到 8102 篇相关文章

推荐文章7

Thin Harness, Fat Skills:AI工程架构的本质

文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。

AI工程化
推荐文章8

《动手写AI Agent》前言 · 先看完成品

作者因想搞懂 Agent 原理,且市面上缺系统学习资料,决定手写一份教程,即《动手写 AI Agent》。书中 Ling 是从零手写的编程助手,介绍了其 8 个应用场景、技术规格,还说明了适合读者与全书路线图。

AI Reading Hub
产品应用8

Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对

文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。

宝玉AI
新闻资讯7

独家|前DeepMap 创始人吴夏青离职英伟达创业,瞄准机器人数据方向

AI科技评论独家消息,前DeepMap创始人、英伟达业务副总裁吴夏青2025年12月离开英伟达,正考察机器人数据领域创业。他是资深地图人,DeepMap曾被英伟达约30亿美元收购。

AI科技评论
新闻资讯8

面壁智能完成新一轮融资,26年累计融资超10亿,跻身基模独角兽行列

面壁智能宣布完成新一轮数亿元融资,由深创投和汇川产投领投。今年一季度累计融资超10亿,其获“2026年度中国独角兽企业”称号。各方看好端侧AI,面壁以‘密度法则’构建技术生态,产品应用广泛。

机器之心
算法论文8

ICLR 2026 Oral|中科院团队提出新框架「SparseRL」,深度强化学习可自动生成高性能CUDA代码

中科院计算所团队提出 SparseRL 框架,将深度强化学习引入稀疏 CUDA 代码生成任务。实验显示,在 SpMV 任务上编译成功率提升 20%,执行速度提升 30%。该成果已入选 ICLR 2026 Oral。

机器之心
推荐文章8

Anthropic 的 Harness 设计:build to delete

Anthropic工程博客发布Harness设计文章,探讨Claude完成全栈应用开发任务。指出单Agent模式问题,采用GAN式对抗、三Agent编排,对比单Agent与多智能体产出,还介绍调教评估者及编排简化,提出Build to Delete原则。

AGI Hunt
7

AI 编程正在终结框架时代

作者认为自动化编程让人们摆脱繁重体力劳动,可专注重要创作。框架解决简化、自动化和劳动力成本问题,但带来诸多弊端。真正的软件工程已回归,应摆脱无用复杂性,自主构建产品。

InfoQ
新闻资讯8

黄仁勋迟到了15分钟,然后甩出一个数字:1万亿美元。

GTC 2026上,黄仁勋获“Token之王”称号。他预计英伟达到2027年营收至少1万亿美元,还展示商业定价模型,推出Vera Rubin系统,整合Groq芯片,开源OpenClaw,预告Feynman架构,开发太空数据中心。

探索AGI
开源动态8

OpenClaw登顶GitHub,满天飞的智能体Skills要怎样设计?

OpenClaw 4 个月获 250K+ Star 登顶 GitHub。智能体 Skills 给大模型装上程序化记忆,研究者解构其概念,阐述设计模式、获取调度逻辑,也指出安全威胁,呼吁建立客观评价体系。

AIGC开放社区