「前向噪声过程」共找到 942 篇相关文章
从零开始200行python代码实现LLM
文章从传统思路出发,用Python实现极简大语言模型,介绍从零基础到Bigram模型的过程,包括词汇表、模型训练推理等内容,还讲解了PyTorch基础,最后实现pytorch版Bigram模型,后续将实现完整GPT。
NLWeb: 让每个网站都装上一个智能的“对话引擎”
微软近日开源NLWeb项目,致力于简化网站构建对话式交互界面的过程。它利用现有网络生态,定义协议让用户或AI代理与网站交互,具有降低门槛、开放社区驱动等优势,目标是构建“AI Web”。
极客说|AI Sales Avatar 探索
本文介绍名品车AI数字导购Vendy搭建过程,以TEN平台为中枢,集成Agora、Azure等五大平台,构建具备听、说、想、演能力的AI数字销售助理,还给出后续扩展建议,推动企业AI转型升级。
面对MCP"工具投毒",我们该如何应对
近期MCP爆火但安全风险显现,安全机构指其有严重漏洞,会致‘工具投毒攻击’。本文介绍通过客户端/服务器代码复刻攻击过程,剖析MCP客户端和服务端安全风险,还给出阿里云的两种安全监控方案。
编码封神,Gemini 2.5 Pro (I/O 版)视频秒转 App!网友:比 o3/Claude 强,Vibe 程序员集结!
谷歌 I/O 大会前,Gemini 2.5 Pro 预览版升级,重点在编码。它搞前端、做 UI 出色,能将视频变互动学习 App,推理速度提升。对标 GPT - 4.1 等,性价比高、表现优,获开发者好评。
利润腰斩也要卷AI!小米模型永久降价99%,雷军还要再砸600亿
今日小米宣布 MiMo-V2.5 系列 API 永久降价,最高降 99%,Token 额度提升。虽 2026 年 Q1 财报显示利润腰斩、营收下滑,雷军仍称今年 AI 投 160 亿,未来三年投 600 亿。此前 DeepSeek 也已降价,中国大模型在 OpenRouter 表现亮眼。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。
Coding Agent 的一个啊哈时刻
作者翻用Codex在SGLD做Qwen - Image/HunyuanVideo的modelopt fp8支持的记录,发现Coding Agent思考过程与人类思路高度一致,如对比中间图和结果图判断量化精度,Infra领域核心技能或被其解决。
不要建一千个 Agent:Ramp 如何用一个 Agent 搞定金融自动化
美国企业金融平台 Ramp 估值 320 亿美元,在 The Pragmatic Summit 分享 AI 实战经验。介绍了从“建一堆 Agent”转向“一个 Agent + 一千种技能”架构,Policy Agent 开发过程,定义“正确”标准,建内部 AI 基础设施及内部编码 Agent 情况。
如何定义“人味儿”?——HeartBench评测体系建设实践
在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。