均匀化理论」共找到 941 篇相关文章

推荐文章7

第十一章 Deep Agents 实战——数据分析与报告生成

本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构输出、多 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构输出优势及数据驱动决策方法。

CourseAI
算法论文8

大模型如何准确读懂图表?微软亚研院教它“看、动手、推理”

多模态大模型处理结构图像有误差放大、推理难等问题。微软亚洲研究院等提出PixelCraft,以高保真图像处理与非线性多智能体推理为支柱,提升结构图像理解性能,在多基准上有增益。

量子位
开源动态8

Z-Image标准版开源:更具可塑性的图像生成全能基座

Z-Image标准版开源,它是为开发者准备的强大画板,解决了生成模型同质问题。其保留完整权重,在微调、风格上潜力大,采用创新架构,训练定位SFT阶段,有完整CFG支持,还提供完善工具链。

AIGC开放社区
推荐文章7

从Prompt到Context:为什么Think Tool是形式的必然?

文章从编译原理视角,为AI工程实践提供理论根基。分析了Prompt和Context Engineering的形式程度,介绍Anthropic的Think Tool,指出其优势及对CoT的超越,还提及未来需为Agent System发展全面形式理论

阿里云开发者
算法论文7

1万tokens是检验长文本的新基准,超过后18款大模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
推荐文章8

一个投资人与他的AI龙虾助手70天真实协作笔记|甲子光年

恒海奇点创始人姜海舟分享与OpenClaw构建的AI Agent协作系统70天经验。他指出企业AI瓶颈在信息结构,提出四个判断,包括AI缺信息、‘眼高手低’者赢、AI不裁人、‘吓尿点’临近,认为窗口期只剩3 - 6个月。

甲子光年
推荐文章7

大概念模型:AI 推理的新范式

大概念模型(LCM)是自然语言处理新范式,侧重结构推理和理解,与 LLM 不同。它依赖结构知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
8

企业落地 NL2SQL,需要的是 AI-ready data 和 小模型

当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程流程’。文章指出先数据后模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程路径等内容。

InfoQ
推荐文章7

如果生活是一场“拟像”,爱和痛苦也是假的吗?

豆瓣读书联合南京大学出版社·守望者,邀四位嘉宾围绕《拟像与拟真》,结合文艺案例与生活现实,探讨波德里亚思想在当下的重要性及“拟像世界”。嘉宾们分享接触波德里亚的经历,解析“拟像”概念、其在文艺作品中的呈现及理论困境。

豆瓣读书