意识可及」共找到 5841 篇相关文章

产品应用7

DeepInsight x ChatBI:个人Agent助手养成计划

文章围绕将ChatBI打造成个人Agent助手展开,从用户视角拆解使用流程,分析提问、反问澄清、结果验证等环节的困难与解决办法,还提MCP协议、通义千问3阿里云百炼服务对Agent开发的助力。

阿里云开发者
新闻资讯7

Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题

OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。

Founder Park
产品应用8

劈柴哥和哈萨比斯亲自站台!谷歌世界模型Project Genie刷屏,幕后团队揭秘60秒不是极限,内存是巨大约束

谷歌发布世界模型原型产品 Project Genie,只需一句话或图就能一键生成玩、交互实时虚拟世界。它借助 Genie 3 等构建,解决了早期世界模型多短板,虽现处实验阶段,但已引发热议,应用潜力大。

AI前线
推荐文章7

从 Langchain 到 Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?

文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化趋势,如AI应用平台低代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架企业级框架平台核心考量。

phodal
8

仅隔一天,OpenAI同步上线o3和o4 mini,它们能调用ChatGPT里的多种工具,基于图像思考。o3是强大推理模型,o4-mini专为快速经济推理优化。即日起部分会员体验,还开源了Codex CLI。

鱼羊
算法论文7

SGLang Custom AllReduce v1 与 v2 实现原理详解

文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法 CUDA graph 支持等内容,还对比了两代差异,并提相关环境变量。

GiantPandaLLM
产品应用7

前百川联创下场、字节腾讯入局,到底谁在看好 AI 播客?

近期前百川智能联创焦的‘来福’、前妙鸭相机产品负责人张月光的 ChatPods 等 AI 播客产品上线。‘来福’播客全由 AI 生成,国内多款同类产品也相继登场。虽产品效果能达格线,但在多数播客场景难替代现有内容。

Founder Park
新闻资讯7

黄仁勋搬来华尔街5000亿,买GPU以按揭了

8月11日,英伟达宣布与六家金融机构合作,成立算力融资平台,欲动员超5000亿美元,把算力做成融资生意。其将英伟达全栈AI基础设施当投资资产,客户按需付费,但英伟达股价不涨反跌,这场豪赌结果待察。

新智元
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小方法的性能,得出拷贝数据单元多、单元大以8或16字节向量化单元拷贝提升带宽等结论。

GiantPandaLLM
推荐文章7

理解Ray Data分布式数据处理原理-源码分析

Ray Data是构建于Ray之上的分布式数据处理库,提供高性能且扩展的API,用于AI场景。文章从源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan流式执行过程。

阿里云开发者