AWS架构讨论:如何只向用户提供PDF中的指定页面?
最近看到一个 AWS 架构问题:
一个电商平台把大量产品目录存储在 S3 中。每个商品只对应 PDF 中几个页面,但完整 PDF 文件可能达到几百 MB
问题:
如何让用户只加载需要的页面,而不是下载整个文件?
评论区主要有几种方案:
方案1:提前拆分 PDF 页面
上传时处理 PDF,将页面拆成独立文件,再通过 S3 + CloudFront 分发
方案2:请求时动态生成
通过 Lambda/ECS 实时读取 PDF,并生成对应页面
方案3:Range Request
利用 HTTP Range 请求读取 PDF 部分内容
方案4:AI/RAG
通过 AI 建立 PDF 索引,再定位对应内容
从工程实践角度看:
对于高并发场景,提前处理 + CDN 分发可能更稳定。
但如果 PDF 经常变化,动态生成可能更灵活。
如果你负责设计这个系统,你会选择哪种架构?
有没有更好的 AWS 方案?
#
aws# #
云服务器#