{"content_id":"klwm55imio","slug":"jev-decision-model-branching-design-and-limitations","locale":"ja","schema_type":"TechArticle","category":"knowledge_base","category_name":"ナレッジベース","title":"Jev決定モデルの分岐設計と限界","summary":"Jevは、定められた選択肢と確率を返すTypeSafe AIの決定モデルです。質問の種類ごとにコードへ接続する方法や型推論、信頼度の解釈、韓国語への適用時に検証すべき項目をまとめています。","sponsorship_disclosure":null,"affiliate_disclosure":null,"commerce_disclosure":null,"author":{"name":"Injoys 編集部","url":"https://injoys.com/ko/about"},"key_points":["Jevは自由な文章ではなく、コードで利用する選択肢と確率を返します。","Choiceはカテゴリの選択、Scoreは段階別の評価、Noulは真である確率を問う形式です。","TypeScript SDKは質問の定義から回答の型を推論します。","confidenceは確率分布を要約した値であり、正答率そのものではありません。","韓国語のサービスでは、独自のデータを使って自動処理率と誤判定率を併せて評価する必要があります。"],"content_markdown":"Jevは、定められた選択肢と確率を返すTypeSafe AIの判断モデルです。自然言語による判断をコードの分岐条件につなげる場合に適しています。出力形式は制限しますが、判断の正確さは保証しません。\n\n価格は2026年9月15日の発表、限界は9月17日に確認した文書に基づきます。\n\n## Jevはどのような役割を担うモデルですか？\n\nJevは入力内容を読み、あらかじめ定義した質問に構造化された答えを返します。評価する内容は`state`に入れます。判断基準は`questions`で定義します。返された答えは分類や優先順位の決定に使えます。\n\nTypeSafe AIはこの方式をSystem Oneモデルと呼びます。学習方式はRLCDという名前で説明しています。これは判断確率の補正に重点を置いた強化学習です。ただし、サービスごとの正確さは別途検証する必要があります。\n\n公式のIntroduction文書では、設計原則を次のように表現しています。\n\n\u003e 個々の質問をコードで組み合わせます\n\u003e\n\u003e TypeSafe AI, Introduction\n\nこれは、質問ごとに1つの判断を担わせるという意味です。複数の判断の組み合わせはコードで処理します。1つのリクエストに含まれる質問は、同じ状態をそれぞれ独立して評価します。詳しい構造は[TypeSafe AI Introduction](https://docs.typesafe.ai/introduction)で確認できます。\n\n## Choice·Score·Noulの比較\n\n質問の種類は、返された答えをコードでどう使うかに応じて選んでください。担当部署はカテゴリーを選ぶ問題です。深刻度は順序のある評価に当たります。特定の要求の有無は真と偽に分けられます。\n\n| 種類 | 問う内容 | 主な戻り値 | コードでの利用 |\n| --- | --- | --- | --- |\n| Choice | 定められたカテゴリーのどれに当たるか | `choice`, `probabilities`, `confidence` | `switch`による分岐 |\n| Score | 説明された段階のどの水準か | `score`, `probabilities`, `confidence` | スコアとしきい値の比較 |\n| Noul | 特定の条件が真か | `noul` | 確率を比較してから`if`で分岐 |\n\n### Choiceの選択肢はどう決めますか？\n\nChoiceでは、1つの質問に最大255個の選択肢を指定できます。選択肢の名前と説明を併せて評価します。一覧にない入力もあり得る場合は、`other`のような項目を検討してください。これは無理な分類を減らすための設計です。\n\nChoiceは与えられた候補から1つを選びます。すべての候補が不適切かどうかも別途判断するには、質問を追加する必要があります。返される確率の合計は1です。定義と制限は[Choiceの文書](https://docs.typesafe.ai/primitives/choice)に記載されています。\n\n### ScoreとNoulはどう違いますか？\n\nScoreは、説明が付いた段階の中で位置を評価します。段階番号は0から始まります。結果は段階番号の確率加重平均です。そのため、整数ではないスコアを返すこともあります。\n\nNoulは、条件が真である確率を0から1の間で返します。0.5付近は、真と偽の確率が近いことを意味します。不満の程度が中くらいという意味に解釈してはいけません。程度を測るなら[Score](https://docs.typesafe.ai/primitives/score)、有無を問うなら[Noul](https://docs.typesafe.ai/primitives/noul)を使ってください。\n\n## 通常のコード・生成モデルとの役割比較\n\n正確な計算はコードに任せ、意味の判断だけをモデルに任せてください。文章を新たに作成する作業は生成モデルの役割です。Jevは答えの範囲が決まった判断に適しています。この区分を基準に、既存機能を置き換える範囲を決められます。\n\n| 作業の条件 | 適した処理方法 | 理由 |\n| --- | --- | --- |\n| 日付の間隔や項目数の計算 | 通常のコード | ルールに従って正確に計算できるため |\n| 顧客からの問い合わせの担当部署への分類 | Jev Choice | 選択肢が決まった意味判断のため |\n| 障害報告の深刻度評価 | Jev Score | 説明された段階の中での判断のため |\n| オペレーターへの接続要求の確認 | Jev Noul | 特定の意図の有無を判断するため |\n| 回答の作成や自由な要約 | 生成モデル | 新しい文字列の生成が必要なため |\n\n文字列の出力を処理する際には、形式を検証するコードが必要になることがあります。Jevは定義された答えの形式を直接返す仕組みです。だからといって、すべての検証や再試行が不要になるわけではありません。公式SDKも通信エラーなどに備えた再試行ポリシーを提供しています。\n\n外部入力の検証と業務ルールのチェックは、引き続き分けて設計してください。モデルの答えが型に合っていても、業務上は間違っている可能性があります。この区分は、公式の[Client SDKs](https://docs.typesafe.ai/sdk)と[モデルの限界に関する文書](https://docs.typesafe.ai/model-jaggedness/jev-1.13)に基づく設計上の解釈です。\n\n## TypeScriptの質問定義と答えの型\n\nTypeScript SDKは質問の定義から戻り値の型を推論します。Choiceの選択肢のキーが、答えとして許される値に結び付きます。その結果、許されていない文字列との比較をコンパイル時に検出できます。SDKに必要な環境はNode.js 20以上です。\n\n次は、公式SDKの呼び出し形式を応用した説明用のコードです。実行結果や正確さを測定した例ではありません。環境変数`TYPESAFE_API_KEY`の設定が必要です。\n\n```typescript\nimport { TypeSafeClient, choice } from \"@typesafe-ai/sdk\";\n\nconst api = new TypeSafeClient();\n\nasync function classifyMessage(message: string) {\n  const result = await api.systemOne({\n    model: \"jev-1.13.0\",\n    state: { message },\n    questions: {\n      topic: choice(\"Classify the subject of message.\", {\n        account: \"Account access or password problems\",\n        delivery: \"Shipment tracking or delivery problems\",\n        other: \"Any subject outside those categories\",\n      }),\n    },\n  });\n\n  return result.answers.topic;\n}\n```\n\nこの例の`choice`の型は`account | delivery | other`です。文字列は実際のTypeScriptでは引用符で表記されるリテラル型です。ただし、型チェックでは問い合わせを正しく分類したかどうかは判断できません。インストール方法と呼び出し仕様は[JavaScript SDKの文書](https://docs.typesafe.ai/sdk/javascript)で確認してください。\n\n## 信頼度の計算例とよくある間違い\n\n`confidence`は返された確率を要約した値です。選ばれた答えの確率と同じ数値ではありません。実際の正答率としてそのまま解釈してもいけません。この違いは、自動実行の基準を作る際に特に注意が必要です。\n\nChoiceの公式の計算式は次のとおりです。\n\n`confidence = (最大確率 - 1 / 選択肢の数) / (1 - 1 / 選択肢の数)`\n\n公式文書の確率分布は`0.6, 0.3, 0.1`です。選択肢は3個です。最大確率0.6を代入すると、confidenceは0.4になります。選択された答えの確率60%と信頼度0.4は異なる指標です。\n\n| よくある解釈 | 正しい解釈 |\n| --- | --- |\n| confidence 0.4は正答率40% | 計算式に従って確率分布を要約した値 |\n| Noul 0.5は普通の水準 | 真と偽に近い確率を割り当てた状態 |\n| Scoreの小数点は精密な実測値 | 定義した段階番号の確率加重平均 |\n| 信頼度が高ければ権限チェックを省略できる | 業務上の権限と実行条件は別のコードでチェック |\n\n数値の意味は公式の[Confidenceの文書](https://docs.typesafe.ai/confidence)に基づきます。権限チェックを分けるという内容は、それを運用に適用した設計上の提案です。\n\n## 価格と応答時間はどう比較しますか？\n\n発表された価格は入力トークン100万個あたり0.042ドルです。出力トークンは無料と案内されています。発表された応答時間の範囲は70~500ミリ秒です。これらの数値は2026年9月15日の会社発表に基づきます。\n\n会社による倍率の比較は、特定のワークフローの評価から得られたものです。実際の正解ではなく、別の大規模モデルの平均予測を基準にしました。速度の評価は主に米国西部で実施されました。したがって、あらゆる業務での正確さや韓国内での応答時間を示すものではありません。\n\n| 比較項目 | 確認する内容 |\n| --- | --- |\n| API費用 | 実際の入力トークン使用量と適用単価 |\n| 応答時間 | サービスが稼働する地域での往復時間 |\n| 正確さ | 実際の業務で正解を付けたサンプルの結果 |\n| 運用費用 | 再試行と人による確認まで含めた費用 |\n\n価格だけを比較すると、確認作業が増える状況を見落とす可能性があります。導入の判断には、処理結果まで含めた費用が必要です。発表数値の条件は[Jevの公開発表文](https://typesafe.ai/blog/introducing-system-one-models-and-jev)に明記されています。\n\n## Jev 1.13の9つの限界\n\n公式文書は、Jev 1.13の失敗の種類を9つにまとめています。この一覧は2026年9月17日に確認した内容に基づきます。一部の事例で成功しても、その作業での信頼性が保証されるわけではありません。\n\n| 失敗の種類 | 設計上の対応 |\n| --- | --- |\n| 文言を文字どおりに解釈 | 暗黙の条件を指示に明記 |\n| 計算と個数のカウント | 算術はコードで処理 |\n| 日付と時刻の比較 | 日付を組み立ててからコードで比較 |\n| 二重否定と複数段階の推論 | 直接的な質問に分割 |\n| 無関係な内容が多い入力 | 必要なフィールドだけを渡す |\n| 判断を誘導する入力 | 誘導する文章を含めて事前に評価 |\n| 指示と選択基準の衝突 | 質問と基準の意味を一致させる |\n| 質問間での数学的な整合性の不足 | 論理関係をコードで管理 |\n| 自由なテキスト生成 | 生成モデルを使用 |\n\n同じ意味でも、NoulとChoiceでは確率が異なることがあります。ある種類で調整したしきい値を、別の種類にそのまま移さないでください。根拠は[Jev 1.13 jaggedness](https://docs.typesafe.ai/model-jaggedness/jev-1.13)です。\n\n## 韓国語サービスへの適用条件\n\n韓国語の入力は処理しますが、英語と同等の性能は保証されません。公式文書では、主な学習言語は英語だと説明しています。韓国語を含むCJK文字圏での性能差も明記しています。一般的な韓国語の正確さを示す数値は提示していません。\n\n韓国語への適用可否は、自社のサンプルで判断してください。遠回しな表現や省略のある問い合わせも含めるとよいでしょう。翻訳文だけを評価すると、実際の顧客の文体との差を見落とす可能性があります。これは言語ごとの性能差を考慮した評価上の提案です。\n\n- 明確な要求と曖昧な要求を分けて評価\n- 部署の分類と感情の評価を別々に集計\n- 英語で決めたしきい値を韓国語で再検証\n- モデル変更の前後で同じサンプルを使って比較\n\n`jev-latest`は新しいバージョンが出ると、参照するモデルが変わります。しきい値を特定のバージョンに合わせた場合は、バージョンの固定を検討してください。言語とバージョンの方針は公式の[Modelsの文書](https://docs.typesafe.ai/models)で確認できます。\n\n## モデルの切り替え評価で見落としやすい自動処理率\n\nモデルを切り替える際は、全体の正確さと自動処理率を併せて見る必要があります。曖昧な案件をすべて人に回すと、自動処理量は減ります。自動処理の範囲を広げると、誤って実行する事例が増える可能性があります。以下は、公式文書の信頼度による分岐を拡張した評価方法です。\n\n| 指標 | 計算または記録の方法 | 確認する目的 |\n| --- | --- | --- |\n| 自動処理率 | 自動処理件数 / 評価件数全体 | 実際に減る手作業 |\n| 自動処理の誤判定率 | 自動処理中の誤判定件数 / 自動処理件数 | 自動化した結果の品質 |\n| 人による確認率 | 確認に回した件数 / 評価件数全体 | 残る確認作業の負担 |\n| 最終処理時間 | 入力から最終的な完了までを測定 | 確認を含む待ち時間 |\n\n自動処理件数がなければ、自動処理の誤判定率は計算できません。この場合は0%ではなく、計算不可と記録してください。指標の分母を残すことで、モデル間の比較が可能になります。\n\n評価は次の順序で進められます。\n\n1. 実際の業務サンプルに人が正解を付けてください。\n2. 質問の文言と選択肢の定義を固定してください。\n3. モデルのバージョン、確率、最終的な分岐を記録してください。\n4. しきい値ごとの自動処理率と誤判定率を比較してください。\n5. 許容するエラーの水準に合わせて運用基準を決めてください。\n\n普遍的に適切なしきい値はありません。誤って実行した場合の影響を基準に反映する必要があります。出発点となる分岐の原則は[Confidenceの文書](https://docs.typesafe.ai/confidence)で確認できます。","content_html":"\u003cp\u003eJevは、定められた選択肢と確率を返すTypeSafe AIの判断モデルです。自然言語による判断をコードの分岐条件につなげる場合に適しています。出力形式は制限しますが、判断の正確さは保証しません。\u003c/p\u003e\n\u003cp\u003e価格は2026年9月15日の発表、限界は9月17日に確認した文書に基づきます。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#jev%E3%81%AF%E3%81%A9%E3%81%AE%E3%82%88%E3%81%86%E3%81%AA%E5%BD%B9%E5%89%B2%E3%82%92%E6%8B%85%E3%81%86%E3%83%A2%E3%83%87%E3%83%AB%E3%81%A7%E3%81%99%E3%81%8B\" class=\"anchor\" id=\"jevはどのような役割を担うモデルですか\"\u003e\u003c/a\u003eJevはどのような役割を担うモデルですか？\u003c/h2\u003e\n\u003cp\u003eJevは入力内容を読み、あらかじめ定義した質問に構造化された答えを返します。評価する内容は\u003ccode\u003estate\u003c/code\u003eに入れます。判断基準は\u003ccode\u003equestions\u003c/code\u003eで定義します。返された答えは分類や優先順位の決定に使えます。\u003c/p\u003e\n\u003cp\u003eTypeSafe AIはこの方式をSystem Oneモデルと呼びます。学習方式はRLCDという名前で説明しています。これは判断確率の補正に重点を置いた強化学習です。ただし、サービスごとの正確さは別途検証する必要があります。\u003c/p\u003e\n\u003cp\u003e公式のIntroduction文書では、設計原則を次のように表現しています。\u003c/p\u003e\n\u003cblockquote\u003e\n\u003cp\u003e個々の質問をコードで組み合わせます\u003c/p\u003e\n\u003cp\u003eTypeSafe AI, Introduction\u003c/p\u003e\n\u003c/blockquote\u003e\n\u003cp\u003eこれは、質問ごとに1つの判断を担わせるという意味です。複数の判断の組み合わせはコードで処理します。1つのリクエストに含まれる質問は、同じ状態をそれぞれ独立して評価します。詳しい構造は\u003ca href=\"https://docs.typesafe.ai/introduction\"\u003eTypeSafe AI Introduction\u003c/a\u003eで確認できます。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#choicescorenoul%E3%81%AE%E6%AF%94%E8%BC%83\" class=\"anchor\" id=\"choicescorenoulの比較\"\u003e\u003c/a\u003eChoice·Score·Noulの比較\u003c/h2\u003e\n\u003cp\u003e質問の種類は、返された答えをコードでどう使うかに応じて選んでください。担当部署はカテゴリーを選ぶ問題です。深刻度は順序のある評価に当たります。特定の要求の有無は真と偽に分けられます。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003e種類\u003c/th\u003e\n\u003cth\u003e問う内容\u003c/th\u003e\n\u003cth\u003e主な戻り値\u003c/th\u003e\n\u003cth\u003eコードでの利用\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"種類\"\u003eChoice\u003c/td\u003e\n\u003ctd data-label=\"問う内容\"\u003e定められたカテゴリーのどれに当たるか\u003c/td\u003e\n\u003ctd data-label=\"主な戻り値\"\u003e\n\u003ccode\u003echoice\u003c/code\u003e, \u003ccode\u003eprobabilities\u003c/code\u003e, \u003ccode\u003econfidence\u003c/code\u003e\n\u003c/td\u003e\n\u003ctd data-label=\"コードでの利用\"\u003e\n\u003ccode\u003eswitch\u003c/code\u003eによる分岐\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"種類\"\u003eScore\u003c/td\u003e\n\u003ctd data-label=\"問う内容\"\u003e説明された段階のどの水準か\u003c/td\u003e\n\u003ctd data-label=\"主な戻り値\"\u003e\n\u003ccode\u003escore\u003c/code\u003e, \u003ccode\u003eprobabilities\u003c/code\u003e, \u003ccode\u003econfidence\u003c/code\u003e\n\u003c/td\u003e\n\u003ctd data-label=\"コードでの利用\"\u003eスコアとしきい値の比較\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"種類\"\u003eNoul\u003c/td\u003e\n\u003ctd data-label=\"問う内容\"\u003e特定の条件が真か\u003c/td\u003e\n\u003ctd data-label=\"主な戻り値\"\u003e\u003ccode\u003enoul\u003c/code\u003e\u003c/td\u003e\n\u003ctd data-label=\"コードでの利用\"\u003e確率を比較してから\u003ccode\u003eif\u003c/code\u003eで分岐\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003ch3\u003e\n\u003ca href=\"#choice%E3%81%AE%E9%81%B8%E6%8A%9E%E8%82%A2%E3%81%AF%E3%81%A9%E3%81%86%E6%B1%BA%E3%82%81%E3%81%BE%E3%81%99%E3%81%8B\" class=\"anchor\" id=\"choiceの選択肢はどう決めますか\"\u003e\u003c/a\u003eChoiceの選択肢はどう決めますか？\u003c/h3\u003e\n\u003cp\u003eChoiceでは、1つの質問に最大255個の選択肢を指定できます。選択肢の名前と説明を併せて評価します。一覧にない入力もあり得る場合は、\u003ccode\u003eother\u003c/code\u003eのような項目を検討してください。これは無理な分類を減らすための設計です。\u003c/p\u003e\n\u003cp\u003eChoiceは与えられた候補から1つを選びます。すべての候補が不適切かどうかも別途判断するには、質問を追加する必要があります。返される確率の合計は1です。定義と制限は\u003ca href=\"https://docs.typesafe.ai/primitives/choice\"\u003eChoiceの文書\u003c/a\u003eに記載されています。\u003c/p\u003e\n\u003ch3\u003e\n\u003ca href=\"#score%E3%81%A8noul%E3%81%AF%E3%81%A9%E3%81%86%E9%81%95%E3%81%84%E3%81%BE%E3%81%99%E3%81%8B\" class=\"anchor\" id=\"scoreとnoulはどう違いますか\"\u003e\u003c/a\u003eScoreとNoulはどう違いますか？\u003c/h3\u003e\n\u003cp\u003eScoreは、説明が付いた段階の中で位置を評価します。段階番号は0から始まります。結果は段階番号の確率加重平均です。そのため、整数ではないスコアを返すこともあります。\u003c/p\u003e\n\u003cp\u003eNoulは、条件が真である確率を0から1の間で返します。0.5付近は、真と偽の確率が近いことを意味します。不満の程度が中くらいという意味に解釈してはいけません。程度を測るなら\u003ca href=\"https://docs.typesafe.ai/primitives/score\"\u003eScore\u003c/a\u003e、有無を問うなら\u003ca href=\"https://docs.typesafe.ai/primitives/noul\"\u003eNoul\u003c/a\u003eを使ってください。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%E9%80%9A%E5%B8%B8%E3%81%AE%E3%82%B3%E3%83%BC%E3%83%89%E7%94%9F%E6%88%90%E3%83%A2%E3%83%87%E3%83%AB%E3%81%A8%E3%81%AE%E5%BD%B9%E5%89%B2%E6%AF%94%E8%BC%83\" class=\"anchor\" id=\"通常のコード生成モデルとの役割比較\"\u003e\u003c/a\u003e通常のコード・生成モデルとの役割比較\u003c/h2\u003e\n\u003cp\u003e正確な計算はコードに任せ、意味の判断だけをモデルに任せてください。文章を新たに作成する作業は生成モデルの役割です。Jevは答えの範囲が決まった判断に適しています。この区分を基準に、既存機能を置き換える範囲を決められます。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003e作業の条件\u003c/th\u003e\n\u003cth\u003e適した処理方法\u003c/th\u003e\n\u003cth\u003e理由\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"作業の条件\"\u003e日付の間隔や項目数の計算\u003c/td\u003e\n\u003ctd data-label=\"適した処理方法\"\u003e通常のコード\u003c/td\u003e\n\u003ctd data-label=\"理由\"\u003eルールに従って正確に計算できるため\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"作業の条件\"\u003e顧客からの問い合わせの担当部署への分類\u003c/td\u003e\n\u003ctd data-label=\"適した処理方法\"\u003eJev Choice\u003c/td\u003e\n\u003ctd data-label=\"理由\"\u003e選択肢が決まった意味判断のため\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"作業の条件\"\u003e障害報告の深刻度評価\u003c/td\u003e\n\u003ctd data-label=\"適した処理方法\"\u003eJev Score\u003c/td\u003e\n\u003ctd data-label=\"理由\"\u003e説明された段階の中での判断のため\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"作業の条件\"\u003eオペレーターへの接続要求の確認\u003c/td\u003e\n\u003ctd data-label=\"適した処理方法\"\u003eJev Noul\u003c/td\u003e\n\u003ctd data-label=\"理由\"\u003e特定の意図の有無を判断するため\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"作業の条件\"\u003e回答の作成や自由な要約\u003c/td\u003e\n\u003ctd data-label=\"適した処理方法\"\u003e生成モデル\u003c/td\u003e\n\u003ctd data-label=\"理由\"\u003e新しい文字列の生成が必要なため\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003e文字列の出力を処理する際には、形式を検証するコードが必要になることがあります。Jevは定義された答えの形式を直接返す仕組みです。だからといって、すべての検証や再試行が不要になるわけではありません。公式SDKも通信エラーなどに備えた再試行ポリシーを提供しています。\u003c/p\u003e\n\u003cp\u003e外部入力の検証と業務ルールのチェックは、引き続き分けて設計してください。モデルの答えが型に合っていても、業務上は間違っている可能性があります。この区分は、公式の\u003ca href=\"https://docs.typesafe.ai/sdk\"\u003eClient SDKs\u003c/a\u003eと\u003ca href=\"https://docs.typesafe.ai/model-jaggedness/jev-1.13\"\u003eモデルの限界に関する文書\u003c/a\u003eに基づく設計上の解釈です。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#typescript%E3%81%AE%E8%B3%AA%E5%95%8F%E5%AE%9A%E7%BE%A9%E3%81%A8%E7%AD%94%E3%81%88%E3%81%AE%E5%9E%8B\" class=\"anchor\" id=\"typescriptの質問定義と答えの型\"\u003e\u003c/a\u003eTypeScriptの質問定義と答えの型\u003c/h2\u003e\n\u003cp\u003eTypeScript SDKは質問の定義から戻り値の型を推論します。Choiceの選択肢のキーが、答えとして許される値に結び付きます。その結果、許されていない文字列との比較をコンパイル時に検出できます。SDKに必要な環境はNode.js 20以上です。\u003c/p\u003e\n\u003cp\u003e次は、公式SDKの呼び出し形式を応用した説明用のコードです。実行結果や正確さを測定した例ではありません。環境変数\u003ccode\u003eTYPESAFE_API_KEY\u003c/code\u003eの設定が必要です。\u003c/p\u003e\n\u003cpre\u003e\u003ccode\u003e\u003cspan\u003eimport { TypeSafeClient, choice } from \"@typesafe-ai/sdk\";\n\u003c/span\u003e\u003cspan\u003e\n\u003c/span\u003e\u003cspan\u003econst api = new TypeSafeClient();\n\u003c/span\u003e\u003cspan\u003e\n\u003c/span\u003e\u003cspan\u003easync function classifyMessage(message: string) {\n\u003c/span\u003e\u003cspan\u003e  const result = await api.systemOne({\n\u003c/span\u003e\u003cspan\u003e    model: \"jev-1.13.0\",\n\u003c/span\u003e\u003cspan\u003e    state: { message },\n\u003c/span\u003e\u003cspan\u003e    questions: {\n\u003c/span\u003e\u003cspan\u003e      topic: choice(\"Classify the subject of message.\", {\n\u003c/span\u003e\u003cspan\u003e        account: \"Account access or password problems\",\n\u003c/span\u003e\u003cspan\u003e        delivery: \"Shipment tracking or delivery problems\",\n\u003c/span\u003e\u003cspan\u003e        other: \"Any subject outside those categories\",\n\u003c/span\u003e\u003cspan\u003e      }),\n\u003c/span\u003e\u003cspan\u003e    },\n\u003c/span\u003e\u003cspan\u003e  });\n\u003c/span\u003e\u003cspan\u003e\n\u003c/span\u003e\u003cspan\u003e  return result.answers.topic;\n\u003c/span\u003e\u003cspan\u003e}\n\u003c/span\u003e\u003c/code\u003e\u003c/pre\u003e\n\u003cp\u003eこの例の\u003ccode\u003echoice\u003c/code\u003eの型は\u003ccode\u003eaccount | delivery | other\u003c/code\u003eです。文字列は実際のTypeScriptでは引用符で表記されるリテラル型です。ただし、型チェックでは問い合わせを正しく分類したかどうかは判断できません。インストール方法と呼び出し仕様は\u003ca href=\"https://docs.typesafe.ai/sdk/javascript\"\u003eJavaScript SDKの文書\u003c/a\u003eで確認してください。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%E4%BF%A1%E9%A0%BC%E5%BA%A6%E3%81%AE%E8%A8%88%E7%AE%97%E4%BE%8B%E3%81%A8%E3%82%88%E3%81%8F%E3%81%82%E3%82%8B%E9%96%93%E9%81%95%E3%81%84\" class=\"anchor\" id=\"信頼度の計算例とよくある間違い\"\u003e\u003c/a\u003e信頼度の計算例とよくある間違い\u003c/h2\u003e\n\u003cp\u003e\u003ccode\u003econfidence\u003c/code\u003eは返された確率を要約した値です。選ばれた答えの確率と同じ数値ではありません。実際の正答率としてそのまま解釈してもいけません。この違いは、自動実行の基準を作る際に特に注意が必要です。\u003c/p\u003e\n\u003cp\u003eChoiceの公式の計算式は次のとおりです。\u003c/p\u003e\n\u003cp\u003e\u003ccode\u003econfidence = (最大確率 - 1 / 選択肢の数) / (1 - 1 / 選択肢の数)\u003c/code\u003e\u003c/p\u003e\n\u003cp\u003e公式文書の確率分布は\u003ccode\u003e0.6, 0.3, 0.1\u003c/code\u003eです。選択肢は3個です。最大確率0.6を代入すると、confidenceは0.4になります。選択された答えの確率60%と信頼度0.4は異なる指標です。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eよくある解釈\u003c/th\u003e\n\u003cth\u003e正しい解釈\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"よくある解釈\"\u003econfidence 0.4は正答率40%\u003c/td\u003e\n\u003ctd data-label=\"正しい解釈\"\u003e計算式に従って確率分布を要約した値\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"よくある解釈\"\u003eNoul 0.5は普通の水準\u003c/td\u003e\n\u003ctd data-label=\"正しい解釈\"\u003e真と偽に近い確率を割り当てた状態\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"よくある解釈\"\u003eScoreの小数点は精密な実測値\u003c/td\u003e\n\u003ctd data-label=\"正しい解釈\"\u003e定義した段階番号の確率加重平均\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"よくある解釈\"\u003e信頼度が高ければ権限チェックを省略できる\u003c/td\u003e\n\u003ctd data-label=\"正しい解釈\"\u003e業務上の権限と実行条件は別のコードでチェック\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003e数値の意味は公式の\u003ca href=\"https://docs.typesafe.ai/confidence\"\u003eConfidenceの文書\u003c/a\u003eに基づきます。権限チェックを分けるという内容は、それを運用に適用した設計上の提案です。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%E4%BE%A1%E6%A0%BC%E3%81%A8%E5%BF%9C%E7%AD%94%E6%99%82%E9%96%93%E3%81%AF%E3%81%A9%E3%81%86%E6%AF%94%E8%BC%83%E3%81%97%E3%81%BE%E3%81%99%E3%81%8B\" class=\"anchor\" id=\"価格と応答時間はどう比較しますか\"\u003e\u003c/a\u003e価格と応答時間はどう比較しますか？\u003c/h2\u003e\n\u003cp\u003e発表された価格は入力トークン100万個あたり0.042ドルです。出力トークンは無料と案内されています。発表された応答時間の範囲は70~500ミリ秒です。これらの数値は2026年9月15日の会社発表に基づきます。\u003c/p\u003e\n\u003cp\u003e会社による倍率の比較は、特定のワークフローの評価から得られたものです。実際の正解ではなく、別の大規模モデルの平均予測を基準にしました。速度の評価は主に米国西部で実施されました。したがって、あらゆる業務での正確さや韓国内での応答時間を示すものではありません。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003e比較項目\u003c/th\u003e\n\u003cth\u003e確認する内容\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"比較項目\"\u003eAPI費用\u003c/td\u003e\n\u003ctd data-label=\"確認する内容\"\u003e実際の入力トークン使用量と適用単価\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"比較項目\"\u003e応答時間\u003c/td\u003e\n\u003ctd data-label=\"確認する内容\"\u003eサービスが稼働する地域での往復時間\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"比較項目\"\u003e正確さ\u003c/td\u003e\n\u003ctd data-label=\"確認する内容\"\u003e実際の業務で正解を付けたサンプルの結果\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"比較項目\"\u003e運用費用\u003c/td\u003e\n\u003ctd data-label=\"確認する内容\"\u003e再試行と人による確認まで含めた費用\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003e価格だけを比較すると、確認作業が増える状況を見落とす可能性があります。導入の判断には、処理結果まで含めた費用が必要です。発表数値の条件は\u003ca href=\"https://typesafe.ai/blog/introducing-system-one-models-and-jev\"\u003eJevの公開発表文\u003c/a\u003eに明記されています。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#jev-113%E3%81%AE9%E3%81%A4%E3%81%AE%E9%99%90%E7%95%8C\" class=\"anchor\" id=\"jev-113の9つの限界\"\u003e\u003c/a\u003eJev 1.13の9つの限界\u003c/h2\u003e\n\u003cp\u003e公式文書は、Jev 1.13の失敗の種類を9つにまとめています。この一覧は2026年9月17日に確認した内容に基づきます。一部の事例で成功しても、その作業での信頼性が保証されるわけではありません。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003e失敗の種類\u003c/th\u003e\n\u003cth\u003e設計上の対応\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e文言を文字どおりに解釈\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e暗黙の条件を指示に明記\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e計算と個数のカウント\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e算術はコードで処理\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e日付と時刻の比較\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e日付を組み立ててからコードで比較\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e二重否定と複数段階の推論\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e直接的な質問に分割\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e無関係な内容が多い入力\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e必要なフィールドだけを渡す\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e判断を誘導する入力\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e誘導する文章を含めて事前に評価\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e指示と選択基準の衝突\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e質問と基準の意味を一致させる\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e質問間での数学的な整合性の不足\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e論理関係をコードで管理\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"失敗の種類\"\u003e自由なテキスト生成\u003c/td\u003e\n\u003ctd data-label=\"設計上の対応\"\u003e生成モデルを使用\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003e同じ意味でも、NoulとChoiceでは確率が異なることがあります。ある種類で調整したしきい値を、別の種類にそのまま移さないでください。根拠は\u003ca href=\"https://docs.typesafe.ai/model-jaggedness/jev-1.13\"\u003eJev 1.13 jaggedness\u003c/a\u003eです。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%E9%9F%93%E5%9B%BD%E8%AA%9E%E3%82%B5%E3%83%BC%E3%83%93%E3%82%B9%E3%81%B8%E3%81%AE%E9%81%A9%E7%94%A8%E6%9D%A1%E4%BB%B6\" class=\"anchor\" id=\"韓国語サービスへの適用条件\"\u003e\u003c/a\u003e韓国語サービスへの適用条件\u003c/h2\u003e\n\u003cp\u003e韓国語の入力は処理しますが、英語と同等の性能は保証されません。公式文書では、主な学習言語は英語だと説明しています。韓国語を含むCJK文字圏での性能差も明記しています。一般的な韓国語の正確さを示す数値は提示していません。\u003c/p\u003e\n\u003cp\u003e韓国語への適用可否は、自社のサンプルで判断してください。遠回しな表現や省略のある問い合わせも含めるとよいでしょう。翻訳文だけを評価すると、実際の顧客の文体との差を見落とす可能性があります。これは言語ごとの性能差を考慮した評価上の提案です。\u003c/p\u003e\n\u003cul\u003e\n\u003cli\u003e明確な要求と曖昧な要求を分けて評価\u003c/li\u003e\n\u003cli\u003e部署の分類と感情の評価を別々に集計\u003c/li\u003e\n\u003cli\u003e英語で決めたしきい値を韓国語で再検証\u003c/li\u003e\n\u003cli\u003eモデル変更の前後で同じサンプルを使って比較\u003c/li\u003e\n\u003c/ul\u003e\n\u003cp\u003e\u003ccode\u003ejev-latest\u003c/code\u003eは新しいバージョンが出ると、参照するモデルが変わります。しきい値を特定のバージョンに合わせた場合は、バージョンの固定を検討してください。言語とバージョンの方針は公式の\u003ca href=\"https://docs.typesafe.ai/models\"\u003eModelsの文書\u003c/a\u003eで確認できます。\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%E3%83%A2%E3%83%87%E3%83%AB%E3%81%AE%E5%88%87%E3%82%8A%E6%9B%BF%E3%81%88%E8%A9%95%E4%BE%A1%E3%81%A7%E8%A6%8B%E8%90%BD%E3%81%A8%E3%81%97%E3%82%84%E3%81%99%E3%81%84%E8%87%AA%E5%8B%95%E5%87%A6%E7%90%86%E7%8E%87\" class=\"anchor\" id=\"モデルの切り替え評価で見落としやすい自動処理率\"\u003e\u003c/a\u003eモデルの切り替え評価で見落としやすい自動処理率\u003c/h2\u003e\n\u003cp\u003eモデルを切り替える際は、全体の正確さと自動処理率を併せて見る必要があります。曖昧な案件をすべて人に回すと、自動処理量は減ります。自動処理の範囲を広げると、誤って実行する事例が増える可能性があります。以下は、公式文書の信頼度による分岐を拡張した評価方法です。\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003e指標\u003c/th\u003e\n\u003cth\u003e計算または記録の方法\u003c/th\u003e\n\u003cth\u003e確認する目的\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"指標\"\u003e自動処理率\u003c/td\u003e\n\u003ctd data-label=\"計算または記録の方法\"\u003e自動処理件数 / 評価件数全体\u003c/td\u003e\n\u003ctd data-label=\"確認する目的\"\u003e実際に減る手作業\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"指標\"\u003e自動処理の誤判定率\u003c/td\u003e\n\u003ctd data-label=\"計算または記録の方法\"\u003e自動処理中の誤判定件数 / 自動処理件数\u003c/td\u003e\n\u003ctd data-label=\"確認する目的\"\u003e自動化した結果の品質\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"指標\"\u003e人による確認率\u003c/td\u003e\n\u003ctd data-label=\"計算または記録の方法\"\u003e確認に回した件数 / 評価件数全体\u003c/td\u003e\n\u003ctd data-label=\"確認する目的\"\u003e残る確認作業の負担\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"指標\"\u003e最終処理時間\u003c/td\u003e\n\u003ctd data-label=\"計算または記録の方法\"\u003e入力から最終的な完了までを測定\u003c/td\u003e\n\u003ctd data-label=\"確認する目的\"\u003e確認を含む待ち時間\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003e自動処理件数がなければ、自動処理の誤判定率は計算できません。この場合は0%ではなく、計算不可と記録してください。指標の分母を残すことで、モデル間の比較が可能になります。\u003c/p\u003e\n\u003cp\u003e評価は次の順序で進められます。\u003c/p\u003e\n\u003col\u003e\n\u003cli\u003e実際の業務サンプルに人が正解を付けてください。\u003c/li\u003e\n\u003cli\u003e質問の文言と選択肢の定義を固定してください。\u003c/li\u003e\n\u003cli\u003eモデルのバージョン、確率、最終的な分岐を記録してください。\u003c/li\u003e\n\u003cli\u003eしきい値ごとの自動処理率と誤判定率を比較してください。\u003c/li\u003e\n\u003cli\u003e許容するエラーの水準に合わせて運用基準を決めてください。\u003c/li\u003e\n\u003c/ol\u003e\n\u003cp\u003e普遍的に適切なしきい値はありません。誤って実行した場合の影響を基準に反映する必要があります。出発点となる分岐の原則は\u003ca href=\"https://docs.typesafe.ai/confidence\"\u003eConfidenceの文書\u003c/a\u003eで確認できます。\u003c/p\u003e\n","tags":["AIエージェント","AI開発","意思決定","開発ツール"],"faqs":[{"question":"Jevは一般的な生成AIの代わりになりますか？","answer":"決められた答えの中から判断する作業に適しています。自由な回答の作成や要約には生成モデルが必要です。"},{"question":"Choiceには選択肢を最大いくつ入れられますか？","answer":"公式のChoiceドキュメントで定める上限は、1つの質問につき255個です。リストにない入力を処理する必要がある場合は、「その他」の選択肢を検討してください。"},{"question":"Noulが0.5なら、普通のレベルという意味ですか？","answer":"真と偽の確率が近いという意味です。程度や水準を評価するには、説明のある段階を使うScoreが適しています。"},{"question":"Scoreの小数点以下の数値は何を意味しますか？","answer":"定義した各段階の番号に確率を掛けて合計した値です。精密な実測値や、その顧客の割合を意味するものではありません。"},{"question":"confidenceが高ければ、正解とみなしてもよいですか？","answer":"confidenceは確率分布を要約した値です。実際に正解かどうかは、業務データのサンプルで確認する必要があります。"},{"question":"TypeScript SDKは何をチェックしますか？","answer":"質問の定義から回答の型を推論します。許可された選択肢以外の文字列との比較を見つけるのに役立ちます。分類内容の正確性まではチェックしません。"},{"question":"Jevを使えば再試行は不要ですか？","answer":"出力形式の処理と通信エラーの処理は別です。公式SDKにはデフォルトの再試行ポリシーがあるため、APIエラーの処理も確認する必要があります。"},{"question":"韓国語の精度はどのくらいですか？","answer":"公式のModelsドキュメントには、一般化できる韓国語の精度の数値は示されていません。実際の韓国語の入力を使い、質問ごとの性能を評価してください。"},{"question":"Jevの料金はいくらですか？","answer":"2026年9月15日に発表された価格は、入力トークン100万個あたり0.042ドルです。出力トークンは無料と案内されていました。適用される価格は公式のModelsドキュメントで改めて確認してください。"},{"question":"運用環境でjev-latestを使ってもよいですか？","answer":"使えますが、新しいバージョンが出ると、紐づくモデルが変わります。しきい値を検証したバージョンを維持するには、そのバージョンIDを指定してください。"}],"sources":[{"url":"https://docs.typesafe.ai/introduction","title":"TypeSafe AIの紹介","type":"source"},{"url":"https://docs.typesafe.ai/primitives/choice","title":"TypeSafe AIの選択","type":"source"},{"url":"https://docs.typesafe.ai/primitives/score","title":"TypeSafe AIのスコア","type":"source"},{"url":"https://docs.typesafe.ai/primitives/noul","title":"TypeSafe AIのNoul","type":"source"},{"url":"https://docs.typesafe.ai/confidence","title":"TypeSafe AIの信頼度","type":"source"},{"url":"https://docs.typesafe.ai/sdk","title":"TypeSafe AIのクライアントSDK","type":"source"},{"url":"https://docs.typesafe.ai/sdk/javascript","title":"TypeSafe AIのJavaScript SDK","type":"source"},{"url":"https://typesafe.ai/blog/introducing-system-one-models-and-jev","title":"System One ModelsとJevの紹介、2026年9月15日","type":"data_point"},{"url":"https://docs.typesafe.ai/model-jaggedness/jev-1.13","title":"Jev 1.13のばらつき、2026年9月17日にレビュー","type":"source"},{"url":"https://docs.typesafe.ai/models","title":"TypeSafe AIのモデル","type":"source"}],"images":[{"id":1601,"url":"https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjQwNDYsInB1ciI6ImJsb2JfaWQifX0=--ea906281db18091febeba00926fa1dd9ebe90294/ai-cb0d0c3f.webp","is_representative":true,"generation_method":"ai_photo","license":"ai_generated","mime_type":"image/webp","width":1536,"height":1024,"translations":{"ko":{"alt":"고객지원 사무실에서 헤드셋을 쓴 두 직원이 모니터를 보며 상의하고, 책상에 청록색 표시등이 켜져 있다.","caption":"신뢰도는 정답률이 아니므로 자동 처리율과 오판율을 함께 평가해야 합니다.","description":null},"en":{"alt":"Two headset-wearing support staff confer over a monitor, with a teal light glowing at their desk and other agents behind them.","caption":"Confidence is not accuracy, so automatic handling and misclassification rates must be evaluated together.","description":null},"ja":{"alt":"カスタマーサポート室でヘッドセットを着けた二人がモニターを見ながら話し合い、机上で青緑色のランプが光っている。","caption":"信頼度は正答率ではないため、自動処理率と誤判定率を併せて評価する必要があります。","description":null},"es":{"alt":"Dos agentes con auriculares consultan un monitor; una luz verde azulada brilla en su mesa y hay más agentes al fondo.","caption":"La confianza no equivale a la tasa de aciertos, por lo que deben evaluarse tanto el procesamiento automático como los errores de clasificación.","description":null},"id":{"alt":"Dua staf dukungan berheadset berdiskusi sambil melihat monitor, dengan lampu hijau kebiruan menyala di meja dan agen lain di belakang.","caption":"Tingkat keyakinan bukan tingkat ketepatan, sehingga penanganan otomatis dan kesalahan klasifikasi perlu dievaluasi bersama.","description":null},"pt":{"alt":"Dois atendentes com fones de ouvido conversam diante de um monitor; uma luz verde-azulada brilha na mesa, com outros agentes ao fundo.","caption":"A confiança não é a taxa de acerto; o atendimento automático e os erros de classificação devem ser avaliados em conjunto.","description":null},"zh-hant":{"alt":"客服辦公室裡，兩名戴耳麥的員工看著螢幕討論，桌上亮著藍綠色指示燈，後方還有其他客服人員。","caption":"信心值不等於正確率，因此須同時評估自動處理率與誤判率。","description":null},"de":{"alt":"Zwei Supportmitarbeitende mit Headsets besprechen sich vor einem Monitor; am Arbeitsplatz leuchtet ein türkisfarbenes Licht.","caption":"Konfidenz ist keine Trefferquote; daher müssen automatisierte Bearbeitung und Fehlklassifikationen gemeinsam bewertet werden.","description":null}}},{"id":1602,"url":"https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjQwNTIsInB1ciI6ImJsb2JfaWQifX0=--d07e76337161b074535590d09b1f479ecd50d738/ai-893d1efb.webp","is_representative":false,"generation_method":"ai_semi","license":"ai_generated","mime_type":"image/webp","width":1536,"height":1024,"translations":{"ko":{"alt":"여성이 분기 화살표가 그려진 테스트 보드에서 문의 카드를 사람 검토 쪽으로 옮긴다.","caption":"Jev의 결정 결과를 자동 처리와 사람 검토로 나누는 분기 설계가 중요합니다.","description":null},"en":{"alt":"A woman moves an inquiry card toward the human-review side of a branching test board.","caption":"Jev’s decisions need a clear path to either automatic processing or human review.","description":null},"ja":{"alt":"女性が分岐を示すテストボードで問い合わせカードを人による確認の側へ移している。","caption":"Jevの決定を自動処理と人による確認に振り分ける分岐設計が重要です。","description":null},"es":{"alt":"Una mujer mueve una tarjeta de consulta hacia la zona de revisión humana de un tablero con bifurcaciones.","caption":"Las decisiones de Jev requieren una ruta clara hacia el procesamiento automático o la revisión humana.","description":null},"id":{"alt":"Seorang perempuan memindahkan kartu pertanyaan ke sisi tinjauan manusia pada papan uji bercabang.","caption":"Keputusan Jev perlu diarahkan dengan jelas ke pemrosesan otomatis atau tinjauan manusia.","description":null},"pt":{"alt":"Uma mulher move um cartão de consulta para a área de revisão humana em um quadro de testes com ramificações.","caption":"As decisões do Jev precisam de um caminho claro para o processamento automático ou a revisão humana.","description":null},"zh-hant":{"alt":"一名女子在有分支箭頭的測試板上，將詢問卡移向人工審查區。","caption":"Jev 的決定需要明確分流至自動處理或人工審查。","description":null},"de":{"alt":"Eine Frau verschiebt eine Anfragekarte auf einer verzweigten Testtafel in den Bereich für menschliche Prüfung.","caption":"Für Jevs Entscheidungen braucht es eine klare Verzweigung zwischen automatischer Bearbeitung und menschlicher Prüfung.","description":null}}}],"published_at":"2026-10-02T23:30:14+09:00","updated_at":"2026-10-02T23:30:14+09:00","license":"cc_by","translation_status":"reviewed","available_locales":["ko","en","ja","es"],"data_locales":["ko","en","ja","es","id","pt","zh-hant","de"],"url":"https://injoys.com/ja/articles/jev-decision-model-branching-design-and-limitations"}