「运行时」共找到 1163 篇相关文章
Cursor SDK正式发布,“cursor” inside!
四月最后一天,Cursor正式发布TypeScript SDK,将智能代理运行时打包成可编程组件,跳出编程工具定义。它提供完整开发套件,支持双模部署,已有公司用其做三件事,还包含关键部分,Composer模型开放有战略价值。
Google悄悄下了一盘大棋:一天三个端侧AI项目同时爆发
Google 一天内三个端侧 AI 项目爆发,包括离线听写 App Eloquent、端侧 AI 示例集 AI Edge Gallery 和端侧大模型推理运行时 LiteRT-LM。云端大模型竞争趋同,端侧 AI 是差异化战场,Google 全栈布局有优势。
提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25
上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。
从 Apple M5 到 DGX Spark ,Local AI 时代的到来还有多久?
近期,黄仁勋将桌面级AI超算DGX Spark交付给马斯克引发热议。同时,Apple Silicon等芯片下放端侧推理能力,本地运行时和端侧模型供给加速成熟。但本地算力等问题仍制约消费终端Local AI大众化落地。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。
加一个JVM参数,让系统可用率从95%提高到99.995%
文章针对高并发系统不稳定问题,定位是系统内存索引切换时 GC 压力大所致。围绕让索引尽早晋升、直接分配到老年代等思路探索优化,经多番尝试,最终实现索引无感切换,使系统可用率达 99.995%。
GPT-5.5好到不敢睡觉,奥特曼连夜写下五大宣言!
GPT-5.5代号「Spud」,在多项测试中表现出色,开发者实测反馈良好。奥特曼在GPT-5.5发布且口碑好时,写下AI五大原则,称AI要民主化、赋能等,还暗示政府需考虑新经济模式应对AI影响。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分
纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师级水平差距明显。
量子计算摆脱GPU!IBM一句话AMD市值暴涨2000亿元:用FPGA芯片即可
IBM宣布在量子计算商业化取得重大进展,能在AMD芯片实时运行量子纠错算法,速度比需求快10倍,无需GPU,用FPGA芯片与量子计算机配合即可,这一突破让AMD和IBM市值均大幅上涨。