「信息交互方式」共找到 1930 篇相关文章
如何实现RAG与MCP集成
文章聚焦RAG与MCP集成,介绍RAG突破传统模型局限及不足,引出Agentic RAG。阐述MCP革新AI工具连接方式,结合二者构建集成架构,还给出实现步骤、优化策略与代码实践,为释放AI系统潜力提供方案。
刚刚!Sam Altman官宣GPT-5今夏登场:超级智能更为重要
在OpenAI官方播客节目中,Sam Altman透露GPT-5今夏或登场,还探讨AGI定义、“星际之门”算力项目、AI硬件等。如模型命名或改,算力项目解决瓶颈,重视超级智能等。
PolyVivid实现多主体视频定制,身份一致性超越现有模型
现有视频生成模型在多主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在多方面优于现有方法,还介绍技术原理、演示效果,证明其在多领域有实用价值。
MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding
文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。
Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键
Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。
快9倍还更清晰?Direct3D-S2一键解锁高效3D生成
在高分辨率三维形状生成中,传统方式有计算与内存瓶颈。南京大学提出Direct3D - S2框架,基于稀疏体积构建,有空间稀疏注意力机制,加速计算,还引入统一格式VAE,生成质量领先,训练成本更低。
转载 | 赖姜研究员等:基于人工智能的结构力学专题序
基于人工智能的结构力学研究因多领域融合取得进展,突破传统瓶颈。《力学学报》组织专题含6篇论文,展示我国科研人员在该领域结合的最新成果,多位专家参与,介绍了专题相关研究及期刊信息。
用 AI 重新定义 RSS 阅读体验FeedMe
FeedMe可一站式了解多信息源新鲜事,轻量自由且可定制。具备多源RSS聚合、AI摘要生成等功能,支持多种部署方式,如GitHub Pages、Vercel、Docker本地部署,还给出开发指南,项目开源方便Fork和自部署。
The Batch: 969 | 谷歌的机器人模型有了腿
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
机器人是具身大模型的「用户」:超维动力如何打通从人类经验到机器人行动?
今年WAIC,超维动力展台的乒乓球桌和双臂机器人开易拉罐演示吸引关注。其机器人90%经验来自人类第一视角数据,超维动力全栈布局,试图打通人类经验到机器人行动链路,目标是建立机器人持续进化方式。