評価のソース公式の評価
TubeLab · 動画脚本
TubeLab · 異なる動画チャンネル向けに脚本を書き、物語の組み立て、文体、テンポ、明快さを比べます。
Karu News での扱い観察中
証拠の予算点数に使いません
元データの時刻不明
直近の同期まだ集めていません
何を、どう測るか
TubeLab Scriptwriter を統一し、12 のタスクと 6 つの文章品質項目で評価します。3 社のモデル審判は自社モデルを評価せず、失敗したタスクにはペナルティを残します。コストと速度は能力に入れません。
この証拠の使い方
観察中:安定した元データ、正確な評価日、再利用の範囲を待っています。表示ページで、検証できる成績の代わりにはしません。
評価の限界と、データの帰属
モデルは Scriptwriter のフローの影響を受けます。OpenAI は最も低い推論段階を使っているため、ほかの段階には当てはめられません。動画の語りは映画の脚本とは異なります。
データのライセンス:安定した成績のエクスポートと、公開集計のライセンスを確認できていません。
成績は TubeLab が公表したものです。元のスコアと Karu News の総合スコアは尺度が異なるため、足し合わせられません。