「大模型应用开发」共找到 9808 篇相关文章
AI 编程正在终结框架时代
作者认为自动化编程让人们摆脱繁重体力劳动,可专注重要创作。框架解决简化、自动化和劳动力成本问题,但带来诸多弊端。真正的软件工程已回归,应摆脱无用复杂性,自主构建产品。
第二代AI预训练范式:预测下个物理状态
英伟达科学家 Jim Fan 发布《第二代预训练范式》,指出当前以 LLM 为代表的第一代范式应用于物理世界时「水土不服」,认为第二代范式是「预测下一个物理状态」,引发机器学习社区讨论。
AI 顶尖科学家、前 OpenAI 联创 Ilya Sutskever 的 18 个最新思考
这是前OpenAI首席科学家Ilya Sutskever离开OpenAI后的深度访谈。他分享了对LLM研究、实现ASI、研究品味等思考,指出Scaling时代结束,强调‘情感’价值函数等,还回应了创业公司SSI规划。
「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配
快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。
Thinking Machines 发布 Tinker,重新定义 LLM 微调的边界
Thinking Machines 发布工具 Tinker,它是灵活的语言模型微调 API,采用‘责任分工’模式,让研究者专注算法创新,不用被运维细节拖累。此模式获 Karpathy 赞赏,目前 Tinker 开始内测,理念受欢迎。
DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配
DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。
API协议全景图:从REST到MCP的选型指南
本文以开源项目 HiMarket 为背景,梳理从传统 Web 到现代 AI 场景下六种主流 API 协议,如 RESTful、GraphQL 等,介绍其核心定位、技术特点与适用场景,助开发者厘清相关概念。
对谈 Macaron 创始人陈锴杰:RL + Memory 让 Agent 成为用户专属的“哆啦 A 梦”|Best Minds
本文访谈 Macaron 创始人陈锴杰,探讨 RL+Memory 让 Agent 发展及 Macaron 产品。他强调 RL 在 Agent 开发重要性,介绍 Macaron 定位、特点、训练方式,还谈及社区设想、RL 应用及产品发展方向等。
吴恩达:不理解计算机的工作原理,你不可能单靠 Vibe Coding 就走向卓越,基础知识依然至关重要
吴恩达指出懂AI的开发者供不应求,但计算机专业应届生失业率上升,因大学课程未跟上时代。他面试看重借助AI助手开发、运用AI基础模块构建应用等能力,强调基础知识仍重要。
文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了
开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件全丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。