推理编程」共找到 3002 篇相关文章

新闻资讯8

谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
产品应用8

AI发现新物质,仅用200小时!不写一行代码,筛选36.7万种物质

微软在Build大会推出企业级AI科研平台Microsoft Discovery,结合专业AI Agent与高性能计算。它能让无编程背景人员用自然语言使用超算与模拟系统,200小时筛选36.7万种物质找新冷却剂。

量子位
推荐文章7

21

本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。

猛猿
新闻资讯8

从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。

InfoQ
开源动态8

让VLA真正跑上机器人:北大团队开源Jetson-PI,Jetson Orin控制频率提升8.66倍

文章聚焦让VLA模型在机器人上高效运行难题。北大等团队提出Jetson - PI方案,从异步推理算法等三层面优化,在Jetson Orin上控制频率提升8.66倍,推动具身智能向工业应用跃迁。

机器之心
推荐文章7

为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。

文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。

AI大模型应用实践
新闻资讯7

AIEC 2026:今天起,Agent开始成为企业里的「新员工」

AIEC 2026人工智能+生态大会在北京召开,聚焦AI从战略部署到产业实践。大会指出大模型发展风向已变,落地竞赛开启,未来AI将成企业员工,还探讨了Agent落地关键及人与AI关系等问题。

机器之心
新闻资讯7

英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年

AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。

甲子光年
开源动态7

两分钟Claude Code模型换成DeepSeek,立省17倍,缓存后爆省120倍

GitHub开源deepclaude,两分钟可将Claude Code模型换成DeepSeek V4 Pro,开销直降17倍。自带上下文缓存机制,重复对话成本降120倍。支持多后端选项,可丝滑切换,还能打破设备限制远程编程

AIGC开放社区
新闻资讯8

超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官

5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。

AI科技大本营