通信延迟」共找到 307 篇相关文章

新闻资讯7

OpenClaw热潮之后,倒计时最后一天 | 线上预约、线下报名

OpenClaw热潮活动倒计时最后一天,由NICE、上海交大人工智能创新协会主办,2026.4.11 14:00 - 17:00举办。多位嘉宾分享,涉及Agent安全防御、智能体身份与通信、大模型进化及个人智能体发展等内容。

深度学习自然语言处理
新闻资讯7

并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈

英伟达推出受DNA结构启发的Helix并行技术,能解决大模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
推荐文章8

创业者闭门探讨:Make for Agent ,其实还是 Make for Human

极客公园组织「Make for Agent」主题闭门 Meetup,探讨 Agent 产品做法。交流聚焦 Agent IM、身份、人类介入、商业模式等问题,指出 Agent 需责任型通信、独立身份,产品设计要兼顾人和 Agent 需求,核心是责任设计。

Founder Park
新闻资讯8

一天两枚“代码核弹”:OpenAI 祭出首个“主打实时协作”的 Codex 模型,谷歌放出 Gemini Deep Think,码力冲到世界前8

OpenAI 发布 GPT - 5.3 - Codex - Spark 研究预览版,专为实时编码设计,降低交互延迟。谷歌更新 Gemini 3 Deep Think,面向科研与工程难题,在多领域测试表现出色,二者引发网友热议。

InfoQ
算法论文8

图谱检索全面 or 效率?蚂蚁&浙大Deep GraphRAG:全都要

传统 RAG 遇复杂 Query 易失效,GraphRAG 带来新三难。蚂蚁与浙大提出 Deep GraphRAG,有层次化检索、Beam - Search 重排、DW - GRPO 强化学习三板斧,实验显示其性能优、延迟低。

PaperAgent
开源动态8

python打造Google(A2A)+MCP,Langchain生态互补

文章介绍Google的Agent2Agent(A2A)协议,它能实现AI代理通信协作,打破平台孤岛。还提及MCP协议,二者互补。重点介绍python - A2A库,它实现A2A规范,与多框架、模型集成,给出实战示例。

CourseAI
产品应用7

关于Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti的理解

文章分析Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU上特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。

GiantPandaLLM
算法论文8

打破显存墙:谢赛宁团队提出CLM,单卡RTX 4090「撬动」1亿高斯点

3D Gaussian Splatting (3DGS) 是流行的新视角合成方法,但显存容量限制其应用于大型复杂场景。谢赛宁团队提出 CLM 系统,基于 3DGS 稀疏性和空间局部性,减少通信开销,可在单卡 RTX 4090 渲染大型场景。

机器之心
新闻资讯7

OpenAI 又发布了一个新的AI Agent~

OpenAI发布新AI Agent Aardvark用于找代码漏洞,流程包括监控Git提交等,测试能发现92%已知漏洞。还公布AI浏览器Altas技术架构,采用进程隔离和IPC通信,启动快,但维护成本高。

探索AGI
新闻资讯8

GPU时代落幕?硅谷巨头集体「叛逃」,英伟达1500亿疯狂自救

去GPU化浪潮来袭,AI竞争焦点从算力规模转向能效比与延迟。谷歌TPU性能提升且成本低,走向商用受青睐。英伟达天价收购Groq,多元架构正终结GPU单极时代,国产芯片需底层创新。

新智元