「代码推理」共找到 3504 篇相关文章
性价比搏击:Grok 4 Fast 推理成本直降 98%
xAI上周五发布旗舰模型轻量化版Grok 4 Fast,推理成本直降98%。它通过强化学习在基准测试表现佳,有原生工具调用能力,采用统一架构,性价比高,或改写大模型竞争规则。
Browser Use 推出 Code Use:直接用代码控制浏览器
Browser Use 发布 0.9.0 版本,推出专为爬取数据设计的 Code Use。它开发特殊 Agent 和定制 LLM 输出特定代码,通过 CDP 直接操控浏览器,效率和准确性理论上更高,还给出使用示例,同时提醒了安全问题。
图解GPT-OSS:架构、消息格式与推理机制等
OpenAI发布首个开源大模型GPT-OSS,虽性能无惊喜,但设计思路有意思。其架构是经典延续,消息格式有巧思,支持三档推理模式,分词器有小进步,这些设计在实际应用和理论上有一定价值。
YOLO + OpenClaw 缺陷检测智能体,低代码实战方案
文章介绍了YOLO + OpenClaw缺陷检测智能体低代码实战方案。先指出实时检测延迟问题,提出离线自动化方案。接着讲训练YOLO模型、创建OpenClaw技能、配置自动化任务及企业微信集成,还对比了与人工质检效果。
灵码+Qwen3-Coder——使用Skill机制实现代码审核
本文探讨在灵码内使用Claude Skills能力,介绍其实现机制、灵码适配方案。还以代码审核场景为例,展示自定义Skill的创建方法,总结Claude Skills优势及应用场景,展望其与MCP的发展前景。
当 AI 下场炒 A 股,「推理」成了新的直觉
海外“AI Trading Battle”实验中,不同大模型交易表现差异大。港科大等团队提出RETuning方法,基于A股数据集验证,显著提升大模型金融预测准确率、推理可解释性,是综合改进方案,但有算力等局限。
当 AI 写了几乎所有代码,软件工程会怎样?
文章探讨 AI 写大部分代码时软件工程的走向。最新模型让开发者有‘顿悟时刻’,如 Google 工程师用 Claude Code 一小时完成去年的工作。AI 编程能力在 11、12 月迎来拐点,专业知识贬值,软件工程师核心能力更重要,也带来诸多挑战。
AI生成苹果Metal内核,PyTorch推理速度提升87%
Gimlet Labs研究显示,AI能自动生成苹果芯片Metal内核,使PyTorch推理速度提升87%,在215个PyTorch模块上平均加速1.87倍。多个模型组合生成最优内核概率更高,不过研究对比方式遭质疑。
200行python代码实现从Bigram模型到LLM
本文从`babygpt_v1.py`出发,逐步加入self-attention机制、position嵌入等,实现完整GPT。介绍Transformer结构,讲解位置编码、单头自注意力等机制的代码实现,还阐述后续层的用途、参数调整及训练效果,最后提及模型优化方向。
Qwen3-Next:迈向更极致的训练推理性价比
文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。