外注ライターや制作会社を評価するとき、「今回の記事は良かった」「最近少し修正が多い」といった印象だけで継続発注を決めていないでしょうか。
外注先そのものを評価するなら、1本の納品結果ではなく、複数案件の品質・納期・修正履歴を同じ基準で記録し、時系列で見る必要があります。
本記事では、外注ライター・制作会社を「品質」「根拠不備」「納期」「修正回数」「専門性」「コミュニケーション」の6軸で100点評価するスコアカードを紹介します。重要なのは点数を付けることではなく、実績の変化から「継続する」「改善を求める」「発注量を縮小する」を判断できる状態を作ることです。
外注先の評価は「1本の合否」ではなく「複数納品の実績」で判断する
外注先評価で最初に決めるべきことは、納品物の検収と、外注パートナーそのものの評価を分けることです。
コンテンツ制作・運用体制の全体像を先に確認したい場合は、コンテンツ制作・運用体制の全体像を参照してください。本記事では、その中でも外注先そのものの継続評価に絞って実務手順を整理します。
1本の記事について「公開できるか」「修正が必要か」を判断するのが納品検収です。一方、外注先評価では、複数の記事や制作物から「この先も発注すべき相手か」を判断します。
サプライヤー評価に関する研究でも、取引先を複数の評価項目から定期的に評価し、それぞれの重要度を考慮して総合判断する考え方が示されています。ただし、研究対象は製造業などであり、その評価項目を外注ライターへそのまま当てはめるのではなく、コンテンツ制作に合わせて設計し直す必要があります。 (doi.org)
外注記事制作であれば、最低限、納品ごとに次の情報を残します。
- 案件名・記事名
- 初稿納品日と約束した納期
- 品質評価
- 根拠・出典の不備
- 修正内容と修正回数
- 修正が必要になった原因
- 専門性に関する評価
- 連絡・進行上の問題
- 最終的な評価コメント
この納品単位の記録を蓄積し、その後に外注先単位へ集約するのが基本です。
外注ライター・制作会社は6つの項目で評価する
外注ライターやコンテンツ制作会社を評価する場合、単純な「文章がうまい・下手」だけでは不十分です。
2025年3月に、記事ライティングの外注経験者150人を対象にランクエストが実施した調査では、ライターへの不満として最も多かったのは「情報ソースが不明確で、根拠が薄い内容が多い」の57.3%(86人)でした。また、専門用語の誤りは31.3%(47人)、読者が求める深さまで掘り下げられていないという回答は24%(36人)でした。 (rank-quest.jp)
同調査では、リサーチ・事実確認について「あまり行われていない」「まったく行われていない」とした回答も合計16.7%でした。外注記事の評価では、読みやすさだけでなく、根拠と専門性を独立して確認する必要があります。 (rank-quest.jp)
そこで、初期運用では次の6項目で評価すると管理しやすくなります。
| 評価項目 | 配点例 | 主な確認内容 |
|---|---|---|
| 品質 | 25点 | 構成、論理、指示への適合、完成度、公開前の手直し量 |
| 根拠不備 | 20点 | 出典不足、根拠と主張の不一致、古い情報、存在しない出典 |
| 納期 | 15点 | 納期遵守、遅延時の事前連絡、修正版の提出速度 |
| 修正回数 | 15点 | 外注先起因の修正・差し戻しがどの程度発生したか |
| 専門性 | 15点 | 用語理解、業界知識、情報の深さ、注意点・例外への理解 |
| コミュニケーション | 10点 | 返信、質問、認識合わせ、問題発生時の報告 |
| 合計 | 100点 |

外注先は文章の完成度だけではなく、根拠・納期・修正・専門性・コミュニケーションを分けて評価します。
配点は業務内容によって変更します。医療・法律・金融など根拠の正確性が重要な記事では「根拠不備」や「専門性」を重くし、ニュース記事など公開速度が重要なら「納期」の比重を上げます。
この配点自体に業界共通の正解があるわけではありません。最初は仮の配点として運用し、実際の品質事故や編集工数との関係を見ながら調整してください。
修正回数は「誰が原因だったか」を分けて記録する
外注先評価で特に誤りやすいのが修正回数です。
たとえば3回修正した記事でも、3回すべてを外注ライターの減点にするとは限りません。発注後にターゲットを変更したり、社内確認で新しい情報を追加したりした場合、それはライターの品質問題ではなく発注側の変更です。
修正は次の3種類に分けます。
| 区分 | 例 | 外注先評価 |
|---|---|---|
| A:外注先起因 | 指示済み要件の漏れ、事実誤認、誤った出典、レギュレーション違反 | 評価対象 |
| B:発注側起因 | 発注後の方針変更、新しい要望、追加情報、ターゲット変更 | 原則減点しない |
| C:責任区分が曖昧 | 指示書自体が曖昧、双方の認識違い | 原因確認後に判断 |

修正回数そのものではなく、修正が必要になった原因を分けてから外注先の評価へ反映します。
この区分をしないと、「発注側の指示変更が多い案件ほど外注先の評価が下がる」という不公平な状態になります。
フリーランスへ業務委託する場合には、発注内容や納期などの取引条件を原則として書面または電子的方法で明示する必要があります。また、1か月以上の業務委託では、フリーランス側に責任がないにもかかわらず、費用を負担せずに内容を変更させたり、やり直しをさせて利益を不当に害したりする行為は禁止されています。 (jftc.go.jp)
したがって、スコアカードは外注先を減点する道具ではなく、「発注側の問題なのか、外注側の問題なのか」を記録する道具として設計することが重要です。
100点満点へ換算し、直近の変化も確認する

累計平均が高くても、直近の評価が下がっている場合があります。全期間と最近の実績を分けて確認します。
各項目は1〜5点で評価すると集計しやすくなります。
- 5点:期待以上
- 4点:基準を安定して満たす
- 3点:合格水準
- 2点:改善が必要
- 1点:重大な問題がある
加重点は、次の式で計算できます。
加重点 = 評価点 ÷ 5 × 配点
たとえば品質が4点で配点25点なら、「4 ÷ 5 × 25=20点」です。
ただし、外注先の判断に「累計平均」だけを使うのはおすすめできません。
過去20本の評価が高ければ、直近3本で品質が急落していても平均値には表れにくいからです。
最低でも、
全期間または四半期の評価
と
直近5件程度の評価
を並べて確認します。
件数が少ない外注先は、点数を確定評価として扱わず「暫定評価」にします。案件難易度も異なるため、単純平均だけではなく、低評価になった案件の理由も必ず確認します。
継続・改善・縮小は「総合点+傾向+重大問題」で判断する
スコアカードを作る目的はランキングではありません。次の発注判断を決めるためです。
初期運用の目安として、例えば次のように設定できます。
| 総合スコア例 | 判断 | 次の対応 |
|---|---|---|
| 90〜100点 | 拡大候補 | 発注量増加、重要案件へのアサインを検討 |
| 75〜89点 | 継続 | 現状の発注を継続 |
| 60〜74点 | 改善対象 | 弱い項目と改善期限を共有 |
| 59点以下 | 縮小・代替検討 | 発注量縮小、別パートナーとの比較を開始 |

外注先の判断は総合点だけで決めず、最近の変化や重大な問題を含めて、次回の発注方針へつなげます。
この点数帯も業界標準ではなく、運用開始時の設定例です。自社データが蓄積したら再調整してください。
さらに、総合点とは別に「重大問題」を設定します。
例えば、
- 存在しない情報源や出典を記載した
- 重要な事実を確認せず誤情報を納品した
- 機密情報を不適切に扱った
- 重大な遅延を事前連絡しなかった
- 同じ重大ミスを改善依頼後も繰り返した
といった事象です。
総合点が80点でも、重大問題が発生しているなら自動的に「継続」と判断せず、人が確認します。
反対に、総合点が一時的に低くても、発注側の不明確な指示が主原因なら外注先だけを縮小しても問題は解決しません。
外注パートナー評価スコアカードを作る6ステップ
1.発注時点で「合格条件」を決める
評価基準は納品後に作るのではなく、発注前に決めます。
記事なら、対象読者、目的、文字数、構成、出典ルール、一次情報の扱い、禁止表現、納期、修正範囲などを明文化します。
合格条件がない状態では、後から客観評価できません。
2.納品ごとに生データを記録する
いきなり「このライターは72点」と評価せず、まず事実を残します。
「納期1日遅れ」「一次情報の出典漏れ2件」「外注先起因の修正1回」のように、後から確認できる記録にします。
3.6項目を1〜5点で採点する
事実をもとに、品質・根拠不備・納期・修正回数・専門性・コミュニケーションを評価します。
評価者によって点数が変わらないよう、「3点とは何か」「1点になる条件は何か」まで決めておきます。
4.外注先単位で集約する
納品単位の結果を外注先ごとにまとめます。
1本だけで判断せず、一定数の案件を見てから継続評価へ移行します。
5.累計と直近実績を比較する
「平均82点」だけではなく、
「累計82点、直近5件は71点」
のように変化を確認します。
品質だけ低下しているのか、納期とコミュニケーションも同時に悪化しているのかまで見ることで、原因を絞れます。
6.評価結果を次の発注条件へ反映する
評価結果を保存するだけでは意味がありません。
高評価なら重要案件や発注量を増やす。低下している場合は「根拠確認を強化する」「初稿前に構成確認を入れる」など、具体的な改善条件を決めます。
サプライヤー評価を扱った研究では、評価内容や評価を伝える頻度と、コミュニケーションの質・取引先側の関与との関係が分析されています。ただし対象は自動車関連サプライヤー138社であり、外注ライターへそのまま因果関係を当てはめられるものではありません。それでも、評価を社内だけで終わらせず、改善のための対話へ利用するという考え方は参考になります。 (onlinelibrary.wiley.com)
スコアカードの記入例
8件の納品実績がある外注ライターAを、次のように評価したとします。
| 評価項目 | 評価 | 配点 | 加重点 |
|---|---|---|---|
| 品質 | 4 | 25 | 20 |
| 根拠不備 | 5 | 20 | 20 |
| 納期 | 4 | 15 | 12 |
| 修正回数 | 3 | 15 | 9 |
| 専門性 | 4 | 15 | 12 |
| コミュニケーション | 5 | 10 | 10 |
| 合計 | 100 | 83 |
83点なら、前述の例では「継続」に入ります。
しかし、直近5件だけを見ると修正回数が「4→4→3→2→2」と悪化している場合は、総合点だけで問題なしと判断せず、差し戻し内容を確認します。
そこで「一次情報の確認不足」が繰り返されているなら、次回から「納品前チェックリストに出典照合を追加する」など改善策まで決めます。
評価は過去を採点するためではなく、次の発注方法を改善するために使うことが重要です。
品質・根拠・専門性を分けると記事の問題が見えやすくなる
記事制作では、「文章として読みやすい」ことと「情報として信頼できる」ことは同じではありません。
Google Search Centralも、ユーザーに役立つ信頼性の高いコンテンツを考える際に、独自の情報・調査・分析があるか、明確な情報源が示されているか、専門性が確認できるか、容易に確認可能な事実誤認がないかなどを自己評価項目として示しています。AI検索についても、独自で価値のあるコンテンツを作る重要性を案内しています。 (developers.google.com)
そのため外注ライターの評価でも、「誤字が少ないから高品質」と一括評価するのではなく、
品質
根拠
専門性
を分離した方が、最終的な読者にとって役立つ記事を作れているか確認しやすくなります。
外注先評価で避けたい5つの運用
外注パートナーを継続評価するときは、次の状態を避けてください。
- 直近1本の印象だけで契約判断する
良い案件・悪い案件の偶然に左右されます。
- 修正回数をすべて外注先の責任にする
発注側の仕様変更を混ぜると評価が歪みます。
- 総合点だけを確認する
重大な根拠不備などが他項目の高評価で隠れる可能性があります。
- 発注後に評価基準を変える
何を満たせば合格なのかを事前に共有できなくなります。
- 点数を付けるだけで改善につなげない
低評価項目について「次回、何を変えるのか」まで決めなければ、同じ問題が繰り返されます。
外注パートナー評価のチェックリスト
継続・改善・縮小を判断する前に、次を確認してください。
- 納品ごとの実績を記録している
- 品質・根拠・納期・修正・専門性・コミュニケーションを同じ定義で評価している
- 修正理由を外注先起因と発注側起因に分けている
- 一時的な印象ではなく複数案件を確認している
- 累計評価だけでなく直近の変化も見ている
- 重大問題を総合点とは別に管理している
- 点数の根拠となる具体的な事実を残している
- 低評価項目について改善条件を設定している
- 評価後の発注量・担当領域まで決めている
まとめ
外注ライターや制作会社を正しく評価するには、1本ごとの「合格・不合格」で終わらせず、複数納品の実績を同じ基準で蓄積する必要があります。
基本となるのは、品質・根拠不備・納期・修正回数・専門性・コミュニケーションの6項目です。
そのうえで、「累計の実績」と「最近の変化」を比較し、重大な問題も別に確認します。
特に修正回数は、外注先起因なのか、発注側の仕様変更なのかを区別してください。
スコアカードの目的は外注先を順位付けすることではありません。どのパートナーへ発注を増やし、どこを改善してもらい、どの取引を縮小するのかを、感覚ではなく実績から判断できる状態を作ることです。
参考文献・データ元
-
公正取引委員会「フリーランス法特設サイト」。取引条件の明示義務、不当な給付内容の変更・やり直し、中途解除等に関する確認に使用。
参考元URL:https://www.jftc.go.jp/freelancelaw_2025/index.html -
ランクエスト「外注ライティングに関する満足度調査」。2025年3月11日、全国のライティング外注経験者150人を対象としたオンライン調査。外注ライターへの不満、事実確認、専門性等の確認に使用。
参考元URL(前編):https://rank-quest.jp/column/industry-research/outsourcedwriting_investigation_part1/
参考元URL(後編):https://rank-quest.jp/column/industry-research/outsourcedwriting_investigation_part2/ -
Google Search Central「Creating Helpful, Reliable, People-First Content」。独自性、情報源、専門性、事実確認などコンテンツ品質の考え方に使用。
参考元URL:https://developers.google.com/search/docs/fundamentals/creating-helpful-content -
Google Search Central「Top ways to ensure your content performs well in Google’s AI experiences on Search」。AI検索における独自で価値あるコンテンツの重要性確認に使用。
参考元URL:https://developers.google.com/search/blog/2025/05/succeeding-in-ai-search?hl=en -
Petroni, A. & Braglia, M. (2000), “Vendor Selection Using Principal Component Analysis,” Journal of Supply Chain Management, 36, 63–69. 複数評価項目による定期的な取引先評価の考え方を確認するために使用。DOI: 10.1111/j.1745-493X.2000.tb00078.x
参考元URL:https://onlinelibrary.wiley.com/doi/10.1111/j.1745-493X.2000.tb00078.x -
Prahinski, C. & Fan, Y. (2007), “Supplier Evaluations: The Role of Communication Quality,” Journal of Supply Chain Management, 43(3), 16–28. サプライヤー評価とコミュニケーションに関する考察の補助として使用。DOI: 10.1111/j.1745-493X.2007.00032.x
参考元URL:https://onlinelibrary.wiley.com/doi/abs/10.1111/j.1745-493X.2007.00032.x
