「算法工程师」共找到 941 篇相关文章
DeepSeek 模型技术之旅:从 V3 到 V3.2
本文深入剖析了 DeepSeek 模型从 V3 到 V3.2 的技术演进,对比了基座与推理模型,介绍了架构、训练方法变化,如 V3.2 结合 MLA 与 DSA,更新奖励和 GRPO 算法,还提及 V3.2-Speciale 扩展思考特性。
LLM 技术在有道词典笔上的应用实践
本文围绕LLM技术在有道词典笔的应用展开。先分析端侧大模型落地挑战,如算力、功耗等。介绍有道词典笔等硬件及应用,对比端侧与云侧AI优劣。还阐述模型落地模式、算法优化及“子曰3数学模型”开源情况。
AI 狂潮中,电子业破局:国产先进封装加速突围
AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。
末日来临,会古法编程的我成了救世主
文章介绍网络小说《AI 编程末日,只有我会古法编程》,讲述 2038 年超级 AI 接管代码生产后自毁,全球瘫痪,前腾讯工程师凭手写代码拯救世界。还探讨作者身份,分析不同阶段程序员对 AI 的焦虑,指出小说预言正成现实。
模型训练篇|多阶段ToolRL打造更可靠的AI导购助手
当前,AI导购成电商与服务平台新风口,但芝麻租赁场景挑战大,存在需求难匹配等痛点。为此打造AI导购智能体“租赁小不懂”,经架构升级和算法优化,性能提升,还探索了MoE训练和推理优化。
智能体系统如何「边做边学」?斯坦福团队探索在线优化的新范式
斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智能体系统能「边做边学」。它由多个智能体模块协作,在多领域基准测试中表现出色,小模型也能超越大模型,为智能体训练提供新思路。
00后投身具身智能创业,剑指机器人界「Model 3」!已推出21个自由度灵巧手
具身智能创业公司灵初智能推出自研灵巧手,每只手21个自由度,操作能力强。其目标是将机器人整机价格打到17000美元,走‘Model 3式的产业破局之路’,还提出分层端到端算法解决训练难题。
快手解密「AI印钞机」,首提生成式强化学习出价技术,为平台实现超过3%的广告收入提升
文章介绍快手首提生成式强化学习出价技术,为平台提升超3%广告收入。还阐述广告自动出价挑战及业界方案,介绍快手GAVE和CBD算法破解难题,其团队成果丰硕,未来技术有两大演进方向。
OpenAI要跳过5.3,直接迈向GPT-5.4了?
近日,一名OpenAI工程师在公开的Codex GitHub仓库中提交拉取请求,让GPT - 5.4型号出现在代码版本判断条件中,同时有用户发现它曾短暂出现在Codex应用的模型选择器里。线索被迅速修改或删除,引发诸多猜测。
量子计算摆脱GPU!IBM一句话AMD市值暴涨2000亿元:用FPGA芯片即可
IBM宣布在量子计算商业化取得重大进展,能在AMD芯片实时运行量子纠错算法,速度比需求快10倍,无需GPU,用FPGA芯片与量子计算机配合即可,这一突破让AMD和IBM市值均大幅上涨。