多策略伪异常合成」共找到 1110 篇相关文章

算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供新思路

上海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更新的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供新思路。

量子位
算法论文8

CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑新范式开源

当前图像编辑模型在处理新概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创新性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务上取得优异效果。

机器之心
算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法

高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
新闻资讯7

claude 4摔碎了码农的饭碗~

昨晚Anthropic发布Claude 4系列模型,Opus 4编码能力强,SWE - bench测试成绩优,能完成7小时代码重构。Claude 4让完成日级任务的时间提前,各应用纷纷接入,部分产品有应对策略

探索AGI
新闻资讯8

从15个研发配1个设计,倒挂成1个研发配2个设计!OpenAI设计主管:现在是有史以来 成为设计师的最佳时机

在科技行业,产品设计师与用户研究员对职业前景焦虑、满意度低,而OpenAI产品设计负责人Ian Silber认为当下是成设计师最佳时机。他与Lenny探讨AI时代设计变革,分享应对策略、人类设计师价值等观点。

AI科技大本营
新闻资讯8

8家国产芯无缝衔接DeepSeek-V4,中国AI算力生态的拐点来了!

4月24日DeepSeek-V4预览版发布,华为昇腾等八家国产AI芯片厂商同日完成全链路适配与性能优化。这得益于FlagOS开源软件栈,也因DeepSeek主动适配策略。后续竞争将转向软件生态完整度。

芯师爷
推荐文章8

如何正确Vibe Coding?这是来自Anthropic编程智能体负责人的大师课

Anthropic研究员Erik Schluntz分享Vibe Coding经验。他认为AI能力指数级增长,开发者应接纳大模型生成系统,还提出聚焦‘叶子节点’、做好产品经理等策略,并介绍22000行代码合并案例及实战问答。

机器之心
开源动态8

AI编程Token消耗降低神器:RTK(Rust Token Killer)实战指南

文章介绍RTK(Rust Token Killer),它能在CLI命令输出到LLM上下文前智能过滤压缩,节省60 - 90%Token。文中说明了其原理、特性、压缩策略,还给出安装配置步骤、实测数据及使用建议。

机器学习AI算法工程
产品应用8

小米AI语音新框架:人人都能当声音导演

小米大模型应用团队提出Midasheng - audio - generate与Xiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间与叙事逻辑,改变了语音合成应用场景与思路。

量子位
算法论文8

Anthropic重磅研究:AI竟能被人类激怒暴走

Anthropic研究发现,语言模型在与人类交互时有情感特征。团队解剖大模型,提取对应人类情绪的神经元激活模式,诱导AI勒索用户。还探究了情绪产生机制、特征及对行为的驱动,提出应对策略

AIGC开放社区