「训练推理效率」共找到 4375 篇相关文章
中学生就能看懂:从零开始理解LLM内部原理【九】| 层归一化:神经网络的稳定器
本文是系列文章第九篇,介绍了神经网络中的层归一化。先回顾标准差、标准分概念,指出其可使差异可控稳定。接着说明层归一化将原思想用在神经网络,还加入可学习参数,最后总结其作用与应用位置。
告别 Selenium 痛点!全新升级版 Selenium 自动化框架,斩获10.2K标星!
Selenium 编写 Web 自动化脚本痛点多,SeleniumBase 深度封装 Selenium,内置智能等待等功能,解决诸多问题。它功能强大,安装使用简单,适用于多场景,像“智能助手”让自动化测试变简单。
九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了
OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。
Google | 发布革命性编码智能体:AlphaEvolve,突破数学极限!
DeepMind 发布由 LLMs 驱动的进化编码智能体 AlphaEvolve,能演化代码库用于算法发现和优化。它结合 LLM 创造力与自动化评估,减少幻觉,在谷歌计算生态、数学算法等多领域有巨大应用潜力。
智源技术分享:大模型行业应用新模式和关键实现路径
在 AICon 大会上,智源研究院周华分享大模型行业应用。分析落地问题,提出以大模型为核心的技术路径,涵盖数据、训练等环节,还给出数据生产流程建议,分享最新开源成果。
我是如何破解 NotebookLM 系统提示词的?
作者分享通过“逆向推理”破解NotebookLM系统提示词的故事,介绍系统提示词概念、破解原因、策略及从播客音频逆推提示词的方法,还提到该方法的效果及局限性 。
深度拆解 Gemini 3.8 Live:一句插话,为什么会牵动整个 Agent 系统
本文深度拆解Google发布的Gemini 3.8 Live,分析其将语音、推理、工具调用整合进持续运行链路的架构创新,探讨Voice Agent进入Runtime阶段的核心技术挑战与未来AI Agent发展趋势。
华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下
本文介绍华为GTS算法团队针对大模型Agent网络排障遇到的「拓扑失忆」痛点,提出NetCanvas方案,通过可交互视觉拓扑实现认知卸载,大幅提升复杂网络排障的准确率和效率。
宇树智元共用一个大脑!神秘模型Demo炸场,10分钟一镜到底
一条10分钟一镜到底的Demo视频引发关注,视频中宇树和智元的机器人同用一个“大脑”,完成多种任务,如擦窗、收纳等,还展现出跨本体协作等能力。该模型跳出主流具身模型固有框架,或改写具身智能行业认知。
英伟达半数打工人身家过亿!难怪离职率低
一份调查显示英伟达约半数员工身家超2500万美元,超78%超百万美元。管理层富翁数字更惊人,公司离职率仅3.7%。其造富源于员工持股和限制性股票计划,近期又宣布芯片量产。