「超低延迟」共找到 3051 篇相关文章
鹅厂门口免费装龙虾,几百人排爆了!一代人有一代人的鸡蛋要领
腾讯云工程师在鹅厂门口免费为几百人安装OpenClaw,提供“从装到玩”服务。OpenClaw是开源智能体框架,像“龙虾”,可自动操作电脑。目前GitHub Star数超27.04万,多家公司跟进。
32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世
现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。
AI时代,为什么我极力推荐你开始写日记?
本文指出在AI时代,日记是个人存在于世界的真实锚定。马伯庸、罗振宇都重视记录,作者介绍低门槛日记方案,强调日记要真实,还可让AI做回顾,呼吁大家从现在开始记日记。
字节跳动发布Seed 2.0系列模型,数学能力超越GPT-5.2 High
字节跳动Seed团队发布Seed 2.0系列模型,含Pro、Lite和Mini版。该系列在数学、代码、多模态理解等方面表现出色,价格优势明显,但在编程、事实准确性上与部分竞品有差距,已开放API。
「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!
上海交通大学与蚂蚁集团联合团队发布多模态大模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。
视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆
2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。
MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一
MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。
我用GLM-5肝出一个Rust版Agent系统,Opus 4.6迎来了最强开源对手。
作者实测智谱发布的GLM - 5后,用其开发出Rust版Agent系统并开源。还对比GLM - 5与Kimi 2.5、Opus 4.6,认为GLM - 5写后端能力强,让普通开发者也能用高级架构能力。
用嘴聊出来了一个 APP:实测「码上飞」语音开发有多离谱
本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。
老黄大出血!OpenAI背刺英伟达,微软自研芯连夜拆掉CUDA护城河?
2026年1月26日微软官宣第二代自研AI芯片Maia 200上线,还推出软件Triton。它塞满SRAM,推理成本更低、效率更高。这让英伟达面临生存危机,AI算力圈也变天,降本成关键。