「可解释性技术」共找到 6276 篇相关文章
SEO们可以用AI做些什么?
文章围绕SEO与AI展开,介绍AI对搜索方式的改变、SEO前景,还阐述如何让品牌出现在AI回答及引用出处,以及AI在关键词研究、内容创作、站内SEO、外链建设等方面的应用,为SEO从业者提供新思路。
Temperature Scaling可大幅提高Test-Time Scaling瓶颈!
大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。
AI 企业 Day 0 出海,如何少走技术弯路?
InfoQ与多家AI出海企业交流发现,很多企业放弃常见Agent平台和流行框架,选择自研全栈平台。GMI Cloud升级产品,构建完整基础设施图谱,解决全球算力部署、模型调用和Agent商业化落地问题。
一篇200+文献的视觉强化学习技术最新综述
NUS、浙江大学和香港中文大学对强化学习与视觉智能交叉领域进行系统梳理,归纳200余篇工作为四大主题支柱,剖析算法等进展,提炼关键趋势,还介绍LLM的RL方法、视觉RL阵地等。
全网开测GPT-oss!技术架构也扒明白了
全网开测GPT-oss,它登顶开源模型王座,性能比肩o3-mini、o4-mini,适合本地推理。网友探索出多种用法,还推出Pro版。其架构也被扒出,官方介绍了微调方法,吴恩达等大佬也参与测评。
解读Qwen3文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
Anthropic 技术栈里的「五宗罪」由何而来?
Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行时的5个具体位置,导致各方面互相拖后腿。
聚焦低空经济赛道,全球MLCC技术演进与市场机遇
随着低空开放政策落地,中国低空经济进入关键周期,无人机成产业增长核心引擎。市场从消费级向工业级跃迁,MLCC作为关键元件用量与价值跃升。国产微容科技推出高端方案,与多家企业合作供货。
谷歌开源 Colab MCP Server,AI 智能体可云端运行代码
谷歌开源 Colab MCP Server,使 AI 智能体通过 MCP 与谷歌 Colab 交互,将本地智能体工作流与云端执行环境打通,解决本地部署局限,还反映 AI 智能体与外部工具交互标准化趋势。