For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
メインナビゲーション
Codex

Codex use case

未整理データのクリーニングと準備

元のファイルを変更せずに表形式データを処理します。

Difficulty 初級
Time horizon 5分

未整理の CSV やスプレッドシートをドラッグするかメンションし、把握している問題を説明して、元のファイルを変更せずにクリーニング済みのコピーを作成するよう ChatGPT に依頼します。

最適な用途

  • 日付や通貨の形式が混在し、重複行、集計行、欠損値を含む CSV またはスプレッドシートのエクスポート。
  • 複数のソースから得たデータを扱うチーム。

Contents

    ← すべてのユースケース

    未整理データのクリーニングと準備

    元のファイルを変更せずに表形式データを処理します。

    未整理の CSV やスプレッドシートをドラッグするかメンションし、把握している問題を説明して、元のファイルを変更せずにクリーニング済みのコピーを作成するよう ChatGPT に依頼します。

    初級
    5分

    未整理の CSV やスプレッドシートをドラッグするかメンションし、把握している問題を説明して、元のファイルを変更せずにクリーニング済みのコピーを作成するよう ChatGPT に依頼します。

    初級
    5分

    最適な用途

    • 日付や通貨の形式が混在し、重複行、集計行、欠損値を含む CSV またはスプレッドシートのエクスポート。
    • 複数のソースから得たデータを扱うチーム。

    スキルとプラグイン

    • Spreadsheet
      表形式ファイルを調べ、列をクリーニングして、レビューしやすい出力を生成します。
    Skill Why use it
    Spreadsheet 表形式ファイルを調べ、列をクリーニングして、レビューしやすい出力を生成します。

    開始用プロンプト

    @marketplace-risk-rollout-export.csv をクリーニングしてください。 問題点: - 日付が MM/DD/YYYY と YYYY-MM-DD の 2 つの形式で混在している - 通貨の値に $ やカンマが含まれ、空白セルもある - エクスポートを繰り返したことで、一部の顧客行が重複している - 地域名とカテゴリ名に複数の別名が使われている - 貼り付けられた集計行がデータに混在している 希望する処理: - クリーニング済みの CSV を作成する - 元のファイルは変更しない - 日付形式を 1 種類に統一する - 通貨の空白セルは空白のままにする - 可能な場合は元データの行 ID を保持する - 変更した行、削除した行、確実にクリーニングできなかった行を記載した簡潔なデータ品質メモを追加する
    @marketplace-risk-rollout-export.csv をクリーニングしてください。 問題点: - 日付が MM/DD/YYYY と YYYY-MM-DD の 2 つの形式で混在している - 通貨の値に $ やカンマが含まれ、空白セルもある - エクスポートを繰り返したことで、一部の顧客行が重複している - 地域名とカテゴリ名に複数の別名が使われている - 貼り付けられた集計行がデータに混在している 希望する処理: - クリーニング済みの CSV を作成する - 元のファイルは変更しない - 日付形式を 1 種類に統一する - 通貨の空白セルは空白のままにする - 可能な場合は元データの行 ID を保持する - 変更した行、削除した行、確実にクリーニングできなかった行を記載した簡潔なデータ品質メモを追加する

    はじめに

    ChatGPT は、表形式データを体系的にクリーニングすることに優れています。 CSV やスプレッドシートに、複数の日付形式、重複行、通貨文字列、空白セル、別名、貼り付けられた集計行が含まれている場合は、元のファイルを変更せずにクリーニング済みのコピーを作成するよう ChatGPT に依頼してください。

    使用方法

    1. ファイルを ChatGPT にドラッグするか、プロンプト内で、たとえば @customer-export.csv のようにメンションします。
    2. すでに把握している問題を説明します。
    3. クリーニング後のデータを CSV、スプレッドシートのタブ、アップロード可能なファイルのどれにするか、ChatGPT に伝えます。
    4. 使用する前に、クリーニング済みのコピーをレビューします。

    初回のクリーニングには、このページのスタータープロンプトを使用してください。ファイル名と箇条書きの内容を、自分のデータに合わせて置き換えてください。重要なのは、すでに把握している問題と、次に必要なファイル(クリーニング済みの CSV、クリーニング済みのスプレッドシートタブ、アップロード可能なファイル)を具体的に伝えることです。ChatGPT がクリーニング済みのコピーを作成したら、そのデータを後続の処理で使用する前に、クリーニング済みファイルとチャット内のデータ品質メモを開いて確認してください。

    関連するユースケース