推理方法」共找到 3295 篇相关文章

开源动态8

PDF解剖大师来了!LandingAI开源神器,这个Python库让百页文档秒变结构化数据!

复杂文档处理是数据分析痛点,传统方法常因布局复杂失准。LandingAI团队在GitHub开源Python库Agentic - Doc,可从复杂文档提取结构化数据,支持多格式,新增多项功能,提升处理效率和准确性。

开源星探
产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
推荐文章7

AI 编程越来越厉害了,我要怎么提升自己的系统架构能力?

文章指出 AI 写代码能力提升,对程序员系统架构能力要求更高且难被替代。介绍系统设计概念,分析做系统设计的难点,给出新人提升系统设计能力的方法,还说明 AI 可辅助提升该能力。

宝玉AI
算法论文8

ETT:打破原生多模态学习视觉瓶颈,重塑视觉tokenizer优化范式

本文由多机构联合完成,针对传统视觉 tokenization 方法优化与下游任务训练割裂问题,提出 ETT 调优方法。它实现联合优化,在多模态理解、生成、重构任务表现出色,虽有局限但带来新突破。

机器之心
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元
开源动态8

让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力

上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。

机器之心
算法论文7

DeepSeek用的GRPO有那么特别吗?万字长文分析四篇精品论文

文章解读 Kimi k1.5、OpenReasonerZero、DAPO 和 Dr. GRPO 四篇论文,分析 DeepSeek R1 里 GRPO 及改进算法。指出 GRPO 非特殊 RL 算法,当前 RL 算法实现相似,变革聚焦价值函数取舍等核心维度。

机器之心
新闻资讯8

谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
开源动态7

JManus - 面向 Java 开发者的开源通用智能体

在Manus火热背景下,Spring AI Alibaba JManus诞生,它是用Java实现的开源OpenManus。可集成多个大模型,功能完善,能让Java开发者低门槛搭建智能体系统,还给出了运行方法及共建思路。

阿里云开发者
推荐文章7

21

本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。

猛猿