推理密集型信息检索」共找到 2637 篇相关文章

产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元
算法论文8

人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人

瑞士洛桑联邦理工学院等机构研究人员让900名美国参与者与人类或GPT - 4就社会议题辩论。发现GPT - 4知晓对手信息时胜率64.4%,说服效果提升81.2%,低/中争议话题更易受其影响。

量子位
产品应用7

终于,无需邀请码,这款刷新GAIA榜单的Agent你立刻就能用!

今年AI圈新品爱用邀请码等三件套,作者对此不满。天工超级智能体(Skywork)不玩套路,在GAIA评测达SOTA级别。它优化办公三件套场景,使用方便,虽有不足但瑕不掩瑜。

花叔
新闻资讯8

谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
推荐文章7

21

本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。

猛猿
产品应用7

豆包,成了人人可用的办公 Agent

作者使用新版豆包工作任务模式,用它分析宇树科技招股书、采集舆情信息,体验云电脑接力等。指出其亮点如云端本地可切换、Skill 生态丰富,也提到云网络限制、手机端无停止按钮等不足。

AGI Hunt
新闻资讯8

从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。

InfoQ
开源动态8

让VLA真正跑上机器人:北大团队开源Jetson-PI,Jetson Orin控制频率提升8.66倍

文章聚焦让VLA模型在机器人上高效运行难题。北大等团队提出Jetson - PI方案,从异步推理算法等三层面优化,在Jetson Orin上控制频率提升8.66倍,推动具身智能向工业应用跃迁。

机器之心
开源动态8

斩获近5w star!这个开源AI工具让你30 秒搞定“过去30天真相”!

信息碎片化时代,last30days开源AI工具聚合各平台“人群智慧”,按真实人群参与度打分合成摘要。它能搜索多平台,v3版有智能搜索等新功能,输出HTML摘要,优点多且易上手。

GitHubStore