本文へ移動
10/7(水) 13:08
あとで読む
評価のソース

TubeLab · 動画脚本

TubeLab · 異なる動画チャンネル向けに脚本を書き、物語の組み立て、文体、テンポ、明快さを比べます。

公式の評価
Karu News での扱い観察中
証拠の予算点数に使いません
元データの時刻不明
直近の同期まだ集めていません

何を、どう測るか

TubeLab Scriptwriter を統一し、12 のタスクと 6 つの文章品質項目で評価します。3 社のモデル審判は自社モデルを評価せず、失敗したタスクにはペナルティを残します。コストと速度は能力に入れません。

この証拠の使い方

観察中:安定した元データ、正確な評価日、再利用の範囲を待っています。表示ページで、検証できる成績の代わりにはしません。

評価の限界と、データの帰属

モデルは Scriptwriter のフローの影響を受けます。OpenAI は最も低い推論段階を使っているため、ほかの段階には当てはめられません。動画の語りは映画の脚本とは異なります。

データのライセンス:安定した成績のエクスポートと、公開集計のライセンスを確認できていません。

成績は TubeLab が公表したものです。元のスコアと Karu News の総合スコアは尺度が異なるため、足し合わせられません。