Amazon Bedrockで指示ファインチューニング(IFT)を実施するため、トレーニングデータをS3バケットに準備しています。Bedrockカスタムモデルのトレーニングデータとして正しい形式の説明はどれですか?
Amazon Bedrockのカスタムモデル(指示ファインチューニング)では、トレーニングデータのフォーマットがJSONL(JSON Lines)形式に限定されます。 選択肢Bは、JSONL形式(1行1JSONオブジェクト)で各レコードに「prompt」(入力)と「completion」(期待する出力)フィールドを含める形式が正しい要件です。このファイルをS3に配置し、Bedrockカスタムモデルジョブで指定します。 選択肢Aは、Parquet形式(Apache Parquetの列指向バイナリフォーマット)はAmazon Bedrockのカスタムモデルトレーニングではサポートされていません。 選択肢Cは、TFRecord形式はTensorFlow独自のバイナリデータ形式であり、Amazon Bedrockではサポートされていません。SageMakerを経由した前処理も不要です。 選択肢Dは、CSV形式はサポートされておらず、「question」/「answer」カラムという要件もBedrockの仕様に存在しません。