亚马逊AWS官方博客

Story2Video 技术实践:从故事文本到可发布短视频的 AIGC Pipeline

内容创作团队常常面临一个问题:把一段故事线快速转成可发布的短视频,涉及脚本、分镜、配音、口型同步和字幕,链路长且难以维持一致性。在这篇文章中,我们向面向视频生成的架构师、AI 工程师和内容平台团队展示如何使用 Amazon Bedrock、ComfyUI 和 Fish-Speech 组合出一条端到端的 AIGC pipeline

企业级 EKS 集群生产环境配置最佳实践

从私有 cluster endpoint、VPC Endpoints、Pod Identity 替代 IRSA,到双 EBS + LVM 隔离容器运行时与四种 CSI Driver 接入,本文把企业级 EKS 的生产配置决策逐项讲透,并沉淀为一套开源 Terraform 模块:一次 apply 约 30 分钟建成集群,配 9 项健康检查验收。

EKS 上的 GPU 工作负载:节点、网络与高性能存储的架构实践

本文是《企业级 EKS 集群生产环境配置最佳实践》系列第二篇,承接第一篇搭建的生产级 EKS 基础,聚焦 GPU 工作负载链路的深度架构实践。文章围绕 GPU 工作负载的三层架构 —— 计算节点、网络邻近性、高性能存储 —— 展开,覆盖 P5 / P5e / P5en / P6(B200 / B300) / G6e / G7e / G7 等 GPU 实例系列的 EFA 多网卡精确摆位(含 p6-b300 非对称拓扑)、四种定价模式的 Launch Template 设计、基于 topology.k8s.aws/network-node-layer-N 的 AWS 原生拓扑感知调度,以及 FSx for Lustre(PERSISTENT_2)与 S3 Express One Zone + Mountpoint CSI Driver 这两类高性能存储按访问模式的选型,并以一套声明式 Terraform 模块完整实现。