「能碳产业大模型」共找到 10507 篇相关文章
Google 2025年6月核心算法更新及应对,以及百度5月7月算法对比
Google发布2025年6月核心算法更新,预计3周完成。此次未透露方向,暂无针对性策略。还介绍了核心算法更新概念、近期更新情况、应对方法,对比了与企鹅算法差异,此外提及百度5月和7月算法对比及MCP协议。
grok 4一图流
文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。
吴恩达推出LLM 后训练免费课程,覆盖三大调优方法:SFT、DPO、RL
吴恩达发布「Post-training of LLMs」课程,由Banghua Zhu主讲,瞄准实用技术,重点介绍SFT、DPO、RL三种后训练方法,有大量动手实验,课程发布后引发热烈讨论。
AI驱动的研究报告生成器Open Deep Research
Open Deep Research是AI驱动的研究报告生成器,用户提问题可获全面且有来源的答案。它采用Next.js 15等技术栈,经多步骤生成综合报告,还介绍了克隆与运行方法及项目地址。
AI的新技能不是提示词,而是上下文工程
最近,“上下文工程”在AI领域备受关注,人们讨论焦点正从“提示词工程”转移至此。构建有效AI智能体的秘诀在于提供的上下文质量,而非代码复杂程度,这正是上下文工程的意义。
字节硬核开源ComfyUI批量处理插件,ComfyUI调参效率暴增10倍!
在ComfyUI的AI创作中,手动调参效率低。近期字节跳动开源ComfyUI Lumi Batcher插件,支持全参数交叉调试等,可让调参像Excel一样简单,极大提升ComfyUI工作流效率。
仅2G内存可跑,刚刚,谷歌开源Gemma 3n,端侧原生多模态!
谷歌全面发布Gemma 3n,将多模态AI功能带入边缘设备并在Hugging Face开源。它原生支持多模态输入输出,针对设备端优化,内存占用低,采用开创性架构,Gemma系列质量也不断突破。
LangChain官方实测:多智能体架构怎么选?
构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。
SkyReels-Audio让嘴型和音频完美匹配不再难
音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。
让AI自动化控制电脑的一切操作automation-mcp
自动化 MCP 是模型上下文协议服务器,为AI提供完整 macOS 桌面自动化能力,如控制鼠标、输入指令等。文章介绍了安装、使用工具、架构、安全权限、集成示例等内容。