推理编程」共找到 2985 篇相关文章

开源动态7

蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理

医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。

CourseAI
推荐文章7

4000 Star,Vibe Coding终级指南:胶水编程

Vibe Coding由karpathy提出,本文分享其终极指南。介绍了胶水编程、方法论精要、工具资源、编码模型性能分级参考等内容,还给出架构与工作流程,建议选第一梯队模型处理复杂任务。

PaperAgent
算法论文8

谷歌揭秘:Multi-Agent 推理时扩展才是未来。

谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理时扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。

探索AGI
推荐文章8

拒绝Vibe Coding!大神揭秘8套AI编程模式

Datasette创始人Simon Willison公开指南,教专业开发者用Claude Code等AI编程工具提效,总结8大实战模式重构程序员工作方式。还提出认知债务概念,Hacker News对此有不同观点。

新智元
新闻资讯7

Mistral AI发布一站式编程助手Mistral Code

法国开源大模型平台Mistral AI发布一站式编程助手Mistral Code,旨在解决企业开发人员使用AI编码工具时的合规与安全障碍。它基于Continue开发,集成四个大模型,还能在私有代码库微调,获早期客户认可。

AIGC开放社区
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

文章记录了GPT - 5的发布情况,介绍其系统构成、减少事实幻觉和谄媚行为等改进,也提到跑分、性格设置等。实测发现写作和情商不如GPT - 4.5,但编程能力强,还感慨AI发展之快。

数字生命卡兹克
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

GPT-5发布,它是统一系统,含多种模型。性能上减少事实幻觉、应对谄媚有进展,跑分强且节能,但无新功能特性。写作不如GPT 4.5,编程表现出色,发布后OpenAI与Google预测交叉跳水。

AI大模型应用实践
新闻资讯7

英伟达老黄收购了一家AI编程公司

英伟达刚收购AI coding初创公司Solver,该公司成立三年,专注编程AI Agent。此前英伟达收购不少降芯片成本或提供AI支持的公司,此次收购契合其构建软件生态层战略,或使AI智能体逼近软件开发核心。

量子位
推荐文章7

TileLang深入详解-第二章-TileLang 核心编程抽象

文章深入解析TileLang核心编程抽象,介绍写kernel的方式,阐述TileLang三层抽象特点及适用场景,展示JIT工作流、接口和执行后端,还提及性能优化、基准测试、正确性校验,最后用GEMM示例对比三层抽象差异并给出使用建议。

GiantPandaLLM
推荐文章7

吴恩达来信:利用编程智能体实现更高效开发

吴恩达认为编程智能体正加速各类软件工作,按加速程度排序为前端开发、后端开发、基础设施、研究。前端开发加速明显,后端开发有提升但幅度小,基础设施和研究方面加速有限。

DeeplearningAI