「大模型预训练」共找到 9687 篇相关文章
刚刚,“云计算一哥”版龙虾发布,奥特曼打着官司也要云站台
亚马逊云科技发布Amazon Quick,可连接本地文件等,打通生态,还是主动的Agent。奥特曼虽打官司仍云站台,OpenAI与亚马逊云深度合作。此外,Amazon Connect扩展成四个AI解决方案,发布会强调Agent是新企业操作系统。
Qwen3.6-Max-Preview来了!
继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览版,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。
Claude Code 开发者分享:如何管理百万上下文
Claude Code开发者Thariq分享管理百万上下文的心得。介绍了context概念、腐烂问题及压缩机制,提出完成操作后的五条岔路,还给出不同场景的决策建议,强调会话管理要平衡信息量和注意力。
Thin Harness, Fat Skills:AI工程架构的本质
文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。
《动手写AI Agent》前言 · 先看完成品
作者因想搞懂 Agent 原理,且市面上缺系统学习资料,决定手写一份教程,即《动手写 AI Agent》。书中 Ling 是从零手写的编程助手,介绍了其 8 个应用场景、技术规格,还说明了适合读者与全书路线图。
Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对
文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。
ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互
新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。
11.4K Star!基于 AI 大神 Karpathy 的编程经验开源的 Claude Code 技能插件。
AI写代码常遇盲目假设、过度设计、乱改代码等问题。开发者把AI大神Andrej Karpathy经验总结成Claude Code插件andrej - karpathy - skills,设定四大原则,还介绍使用、验证及自定义方法。
The Batch: 937 |OpenAI 退出视频生成领域
OpenAI计划关闭视频生成器Sora,将资源重新分配到更有盈利性的投资中。Sora虽能生成高质量视频,但生成耗时久、计算成本高,日亏损约100万美元,其与迪士尼的合作也将结束。
面壁智能完成新一轮融资,26年累计融资超10亿,跻身基模独角兽行列
面壁智能宣布完成新一轮数亿元融资,由深创投和汇川产投领投。今年一季度累计融资超10亿,其获“2026年度中国独角兽企业”称号。各方看好端侧AI,面壁以‘密度法则’构建技术生态,产品应用广泛。