「审查—调整机制」共找到 1213 篇相关文章
腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案
腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。
雷军:小米一直有一颗芯片的梦想
9月25日晚雷军年度演讲深情坦言,小米一直有造芯梦想。其造芯始于2014年松果电子,澎湃S1虽量产但未成功,后停掉SoC研发。2024年小米成功流片3nm芯片,玄戒O1首发于小米15S Pro,表现出色,但雷军称其成功只是第一步。
阿里新开源提出建设性安全对齐方案,向“让用AI的人安全”新范式跃迁
阿里巴巴集团安全部联合多高校发布技术报告,提出建设性安全对齐理念并集成到Oyster - I模型。该理念突破传统防御式机制,构建新博弈框架,实验显示该模型在安全和通用能力上达SOTA水平。
万卡竞赛背后:容器正在成为AI时代的调度大脑
今年 Agent 与 AIGC 应用大爆发,Gartner 预计 2027 年超 75%的 AI/ML 工作负载将用容器技术部署。但现有容器技术栈不能直接用于 AI 业务,需解决两大技术挑战。阿里云 ACK 和 ACS 协同演进,应对挑战并不断突破,还积极投入开源。
Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率
传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。
GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!
一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。
硬核拆解大模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构
本文详细列举 8 个主流大语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。
AI 产品定价指南
本文编译对按量计费平台初创公司 CEO Scott Woody 的访谈,探讨 AI 改变软件定价逻辑、不同类型 AI 公司应对之法,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点。
OOM排查之路:一次曲折的线上故障复盘
文章复盘了整合Paimon数据湖与RocksDB的系统三次OOM故障排查过程,分享曲折经历,介绍MAT、NMT等排查工具,还给出内存问题排查思路,望为相似技术栈者提供启发。
GuardAgent:首个专门为LLM agent提供安全Guardrail 的守卫型agent
近年LLM从对话工具变为可自主执行任务的agent,但带来安全隐私挑战。传统安全监护对其力不从心,为此学者发布GuardAgent,它守卫agent,具通用性、精确判断和免训练部署优势,实验表现佳。