梯度下降法」共找到 551 篇相关文章

开源动态8

动态RAG新工作:效果爆了,代码已开源

大语言模型幻觉问题突出,现有动态RAG方信号不可靠。QuCo-RAG从预训练语料库挖掘统计证据,用客观频率替代主观置信度,实现毫秒级幻觉检测与动态检索触发,代码已开源。

PaperAgent
7

AI不需要海量用户

AI和互联网逻辑不同,互联网需海量用户,因其边际成本趋近零且是消费驱动。而AI有真实边际成本,是生产驱动,更需要重度用户。若用互联网打做AI,会陷入产能黑洞,拖慢发展。

newtype AI
推荐文章7

深度学习中Batch Size对训练过程如何影响?

文章分析深度学习中batch size对训练过程的影响,探讨超大batch优缺点及应对方。用面试、通俗、科学三种方式解答问题,还通过MNIST实验,从迭代速度、梯度平滑程度、收敛速度等指标对比不同batch size情况。

海边的拾遗者
推荐文章7

流量的本质是打开率?这只是平台推荐流量的规则,搜索流量玩不是这样【必看】

作者白杨SEO参加私域运营大会收获颇丰,分享流量相关内容。探讨流量与打开率本质,分析平台推荐流量规则,介绍用户搜索流量逻辑玩,还谈及AI私域获客及跳出平台规则看

白杨SEO优化教程
产品应用8

抽象小视频秒变特效大片:原视频精髓不变角色环境任意换,Luma出品

Luma AI推出Modify Video玩,能将抽象小视频爆改为特效大片,可对角色、场景等任意换,还保留原视频动作运镜。能进行视频动捕、风格迁移、单个元素编辑,性能超越同行Runway。

量子位
算法论文7

大模型“记性差一点”反而更聪明!金鱼损失随机剔除token,让AI不再死记硬背

马里兰大学等团队提出金鱼损失,训练时随机剔除部分token,让模型不逐字记内容,仍学语言规律。实验显示,LLaMA - 2用该方后记忆内容减少,下游任务性能影响小。

量子位
推荐文章7

关键词挖掘3步,帮你找到用户真正想搜的词【干货】

作者白杨SEO结合ChatGPT选题,分享3步关键词挖掘。先找种子词,可从产品、人群需求、对手入手;再拓展长尾词,用搜索引擎、工具、AI辅助;最后数据筛选,看搜索量、竞争度、商业价值。

白杨SEO优化教程
算法论文8

攻克「恶意投毒」攻击!华南理工联合霍普金斯和UCSD,连登TPAMI、TIFS顶刊

华南理工大学计算机学院AI安全团队联合国际高校,聚焦联邦学习中防范恶意投毒攻击。提出FedID和Scope两种创新防御方,前者用多种度量标准和动态加权检测恶意梯度,后者通过逐维归一化等揭示后门维度,均有良好效果。

新智元
推荐文章7

想玩Loop Engineering,可以先从这6个Hook玩开始。

Loop Engineering正火,入手可从Hook玩开始。Hook是循环触发器,在Agent里很常见。文中整理了6个Claude Code的Hook玩,如权限弹窗提醒、开机日程播报等,还提醒接入工作流要注意稳定性和边界。

数字生命卡兹克
推荐文章7

为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办

文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方适用边界。

AI大模型应用实践