View a markdown version of this page

在 Amazon Textract 中设置配额 - Amazon Textract

本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。

在 Amazon Textract 中设置配额

以下是 Amazon Textract 中设置的配额列表,不可更改。有关您可以更改的默认配额限制的信息,请参阅 Amazon Textract 中的默认配额部分。

限制 说明

可接受的文件格式

操作支持 JPEG、PNG、PDF 和 TIFF 文件。(支持 PDF 中使用 JPEG 2000 编码的图像)。Textract 不支持基于 XFA 的 PDF。

文件大小和页数限制

对于同步操作,JPEG、PNG、PDF 和 TIFF 文件的内存限制为 10 MB。PDF 和 TIFF 文件也限制为 1 页。对于异步操作,JPEG 和 PNG 文件的内存限制为 10 MB。PDF 和 TIFF 文件的内存限制为 500 MB,上限为 3,000 页。

特定于 PDF 的限制

最大高度和宽度为 40 英寸和 9000 个点。PDF 不能具有密码保护。PDF 可以包含 JPEG 2000 格式的图像。

文档旋转和图像大小

Amazon Textract 支持所有平面内文档旋转,例如 45 度平面内旋转。

Amazon Textract 支持四面分辨率小于或等于 10000 像素的图片。

查询特定限制

对于同步操作,Amazon Textract 每页最多支持 15 个查询,对于异步操作,每页最多支持 30 个查询。

文本对齐方式

文本可以在文档中水平对齐。系统可以读取水平排列的文本,无论文档旋转到多少度。Amazon Textract 不支持文档中的垂直文本(垂直书写的文本,在日语和中文等语言中很常见)对齐。

语言

Amazon Textract 支持英语、法语、德语、意大利语、葡萄牙语和西班牙语文本检测。Amazon Textract 不会返回其输出中检测到的语言。查询检测仅在英文文档检测中可用。

字符大小

可检测的文本的最小高度为 15 像素。在 150 DPI 时,这与 8 号字体相同。

字符类型

Amazon Textract 支持手写和打印字符识别。只有英语支持手写字符识别。

字符数

Amazon Textract 检测到以下字符:

  • a-z

  • A-Z

  • 0-9

  • a a öööüüüq é é ¿''''''''''''''''e u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u u

  • ! “# $% '& () * +,-./:; =? @ [\] ^ _ {|} ~ > <° € € € € € € € € € € € € € € ¿¿©®™ § ¹ ² ³

AnalyzeID 特定限制 AnalyzeID 仅支持美国护照和美国驾照。
适配器特定限制
  • 适配器训练可接受的数据集配置-训练:5-2500,测试:5-1000,

  • Training/testing 文件格式和大小:JPG、PNG、PDF、TIFF。

  • training/testing 文件的最大大小为 10MB。

  • annotation/pre标签文件的最大大小为 25MB。

  • 预标记文件数组的最大长度为 15。

  • 最大查询响应长度-128 个字符

  • 每页的最大查询数-30