异构对比微调」共找到 785 篇相关文章

推荐文章7

《动手写AI Agent》流式输出:别让用户干等着

文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验差,因无流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式差异,并定义统一的StreamChunk类型。

AI Reading Hub
推荐文章7

编程智能体的核心组件【译】(重发,补图)

文章围绕编程智能体展开,先厘清大语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。

宝玉AI
算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
产品应用8

OpenAI 发布新的 Codex 桌面版,我现在不骂 Codex 难用了

OpenAI发布Codex Desktop App,是macOS桌面应用。它有图形界面,支持定时任务、Skills管理和多Agent并行运行。还对比了与Claude Code的差别,介绍了OpenClaw项目,最后说明不同用户的使用场景和用量定价。

宝玉AI
新闻资讯8

刚刚!微软 | 发布全新一代自研AI芯片Maia 200

微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer
推荐文章8

从 ReAct 到 Ralph Loop:AI Agent 的持续迭代范式

文章围绕AI Agent持续迭代范式展开,指出AI编程助手现存过早退出等问题,介绍了Ralph Loop范式,阐述其核心要素、原理、优势,对比与传统智能体循环差异,还给出使用最佳实践、适用场景与建议。

阿里云开发者
算法论文7

用超图撕开知识边界:16万节点无师自通搞Agentic科研

传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的多体交互。作者提出将文献里n元关系存成超图超边,让LLM在多智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。

PaperAgent
推荐文章7

极速开发出一个高质量 Claude Agent Skills 最佳实践

作者实践开发Claude Agent Skills积累经验分享。先介绍Skill概念,对比与MCP区别;再讲最佳开发实践,如借助AI、利用官方案例等;还给出Claude Skill自身设计、规范等方面的最佳实践及避坑指南。

阿里云开发者
开源动态8

华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能

华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。

机器之心
推荐文章8

认知重建:Speckit 用了三个月,我放弃了——走出工具很强但用不好的困境

本文作者分享使用 Speckit 三个月的踩坑经历,探讨 AI 编程工具落地难题。介绍复合工程与上下文工程理念,提出 AI 工程化方案,对比传统工具,阐述其设计、落地策略及未来趋势,助力解决企业开发痛点。

腾讯技术工程