Vertical Selfie Video of Woman Explaining AI Video Prompts
A 20-second vertical smartphone-style selfie video in one continuous shot: a 29-year-old Japanese woman walks into a small rented room, sets the phone on a desk, sits down, and speaks four lines of dialogue to camera about AI video prompts. The prompt locks a character sheet reference for face and outfit, keeps roll at zero degrees, and syncs lip movement to natural Tokyo Japanese dialogue.
Prompt (original, unmodified)
これらのURLの内容を読み込み、Skillにしてください。Seedance 2.5のプロンプト生成を依頼するときは、必ず毎回このSkillを使ってください。忘れないように覚えておいて。https://t.co/BPHSzqNopm https://t.co/aUJgXKFRip https://t.co/u79zESgiTk また、Skillには以下のルールも追加してください。リップシンク用のセリフを生成するときは、以下のルールに従ってください。・AIが読みにくい難しい漢字は、ひらがなで表現する・数字は漢字で表現しないで(例:二千年、一九二回)、数字は算用数字(例:2,000年、192回)で表現して・英語はカタカナで表現する 【形式】20秒、縦9:16。スマートフォン前面カメラで撮った日常の自撮り動画。最初から最後まで1つの連続ショット。カメラの左右の傾き(ロール)は全編0度。縦画面を水平に保ち、斜めに傾けたダッチアングルにしない。【人物・参照】添付の画像1は、顔のアップ・正面全身・背面全身をまとめた、同じ女性1人のキャラクターシート。人物と衣服の唯一の主参照として使う。開始フレームではない。シートのグレー背景、立ち姿、スタジオ照明、3ビューの配置を動画に引き継がない。シート自体を映したり、シートから場面を切り替えたりしない。最初のフレームから、以下の部屋へ女性がカメラを持って歩いて入る実写映像。女性は架空の29歳、身長163cmの日本人。画像1の顔の骨格、細身の体格と肩幅、華奢な腕、すっとした首、薄い前髪のあるダークブラウンのボブを全編で維持する。すっきりした卵型の輪郭、自然な大きさの目、控えめな日常メイク。涼しげで清潔感があり、自然な微笑みに親しみがある。画像1の鮮やかなコバルトブルーの細リブのタンクトップと、淡いライトブルーのウォッシュ加工のワイドストレートデニムをそのまま使う。タンクトップは浅いスクエアネックで、自然に体に沿うコンパクトなシルエット、丈はデニムのウエスト付近まで。デニムは腰回りが自然に合い、太ももから裾までゆったりしている。画像1のウエスト位置、裾丈、ポケットと色落ちを維持する。裸足、眼鏡とアクセサリーなし。座った姿でも画像1の細身の体格を保つ。【動作】20秒間で、以下の構図と動作の流れを連続して描く。冒頭は女性がカメラを腰付近に持って歩く。机にカメラを置き、自分が椅子へ座り、親しい友達1人に話すように続ける。着席後は一度だけ髪を耳にかけ、最後に小さく手を振ってカメラを取り上げる。歩行、カメラ設置、着席の間も指定の会話はつながる。【環境】日本の小さな賃貸ワンルーム。白い壁と天井、明るい木目の床。木の机と椅子、大きな掃き出し窓、レースカーテン。机の左奥に木枠の卓上鏡、ネイビーのキャンバストート、その横に少数の本。机の手前は空ける。清潔だが生活感のある普通の部屋。全編で物の位置と部屋の形を保つ。鏡に読める顔や別人を映さない。【カメラ・構図の推移】低い手持ちから机上固定へ移る1つの連続ショット。キャラクターシートは人物と衣服だけの参照であり、カメラ構図の参照ではない。0.0〜4.0秒:縦向きの前面カメラを腰付近で持ち、レンズを上へ向ける。ただし見上げるための上下の角度(ピッチ)だけを変え、画面を時計回り・反時計回りには傾けない。手前に胴体とパンツの腰、画面の上方に顎と顔、その背後に広い天井。歩幅に合わせた小さな上下の移動だけがあり、左右への回転はなく、薄暗い入口から窓の明るい部屋へ進む。持っている腕は画面端で短縮され、スマホ本体と握る手は画面外。冒頭は進行方向を見て話す。4.0〜5.8秒:木の机の安定した縦向きスタンドへカメラを置く。スタンドは画面外。カメラを下げ、上下の角度を調整して、窓、机、鏡、バッグの構図へ連続的に移る。左右には回転させない。指先が下端を短く横切り、小さな上下の揺れが減衰して止まる。設置完了時にはロール0度、左右の傾きがない状態で確実に水平が取れている。女性は一時的に画面右へ外れ、椅子に座るため右側から戻る。この短い設置中も声は近くで聞こえる。5.8〜19.5秒:カメラは机の端の安定したスタンドに水平を取って固定し、角度と焦点距離を変えない。少し低い位置からわずかに見上げる、広めの縦構図。ここでの見上げは上下方向の角度だけ。光軸まわりの回転は0度、画面を左右に倒さない。画面中央付近の壁の垂直な継ぎ目や窓の縦枠が画像の縦辺にほぼ平行になる。軽い広角の自然な遠近感は残すが、部屋全体を斜めにしない。奥行きによって机の辺が斜めに見えることと、カメラ自体を傾けることを混同しない。女性は画面中央より右に座る。頭から腰と両前腕まで入り、頭上には広く白い壁と天井を残す。顔のアップにしない。大きな窓とレースカーテンは女性の右後方から背後に見える。木の天板が画面下部から左奥へ斜めに広がる。木枠の鏡とネイビーのバッグは画面左。女性の胴体は左の鏡・机の方向に向き、話しかける際には顔をレンズへ向ける。着席直後に見える一時的な人物の近さを、固定構図のズームにしない。19.5〜20.0秒:女性がカメラへ手を伸ばし、レンズ近くで手がぼけ、カメラを左右に傾けず持ち上げ、画面が少し上へ移動したところで終了。カット、場面リセット、ズーム、人物を追うパン、ダッチアングル、左右の傾き、光軸まわりの回転は禁止。固定区間の画角変化を起こさない。背景はスマホらしく判別できる。スマホ本体や別の撮影機材は映さない。【光と実在感】冒頭は入口の薄暗さから窓の自然光へ露出が自然に変わる。着席後は画面右後方の窓から入る柔らかな自然光と白い壁の反射。頬の細かな毛穴、産毛、薄い目元の陰影、唇の細い皺、自然な皮脂の反射を保つ。微かな左右差のある笑顔、自然な瞬きと呼吸、話す内容に合った小さな眉の動き。肌を滑らかに加工しない。美顔フィルター、CG的な肌、広告のような照明は使わない。微細なスマホ映像の質感を保つ。【タイミング・演技】0.0〜6.2秒:最初の0.2秒からセリフ1。部屋へ歩き、カメラを置き、椅子へ移動しながら話す。「シーダンス2.5」を明瞭に発音する。冒頭でレンズをのぞき込まない。手はカメラ設置に使い、追加のジェスチャーはしない。6.2〜8.8秒:椅子へ腰を下ろしながらレンズへ顔を向け、セリフ2。「けど」の前に短い間。笑みが少しほどけ、眉をわずかに寄せる。「むずかしいの」で共感を求めるように軽く首を傾ける。深刻な表情や大げさな落胆にはしない。8.8〜16.7秒:セリフ3。表情が柔らかく戻る。話しながら一度だけ片側の髪を耳にかけ、手を下ろす。「ポストに書いたから」で小さくうなずく。「ブックマークしておいてね」はレンズをまっすぐ見て、少しだけ念を押す親しみのある言い方。指差しや大振りのジェスチャーはしない。16.7〜18.6秒:短く息を継ぎ、セリフ4。自然に笑みが広がり、片手を頬の横まで上げ、手首で小さく一往復振る。18.6〜19.5秒:発話を終え、手を下ろしながら柔らかな余韻の笑顔。19.5〜20.0秒にカメラへ手を伸ばし、取り上げる途中で終了。時間帯は連続した演技の目安。各境界で停止したり画面を切り替えたりしない。【音声・セリフ】自然な東京の日本語。29歳の女性の落ち着きのある、少し息を含んだ明瞭な声。少し早口で、友達に話す軽快なテンポ。全セリフを約18秒で話す。棒読み、アナウンサー調、過剰に高い声、販売員のような強調は避ける。文の間に短い自然な間を入れる。口の動きを日本語の発音に同期させる。次の4文だけを、順番どおり、一字一句変更せずに話す。追加、言い換え、繰り返しはしない。セリフ1:エーアイでこういう動画を作るなら「シーダンス・ニーテンゴ」が最高。セリフ2:けど、プロンプトがむずかしいの。セリフ3:いいプロンプトを作る方法をポストに書いたから、ブックマークしておいてね。セリフ4:じゃあ、またね。「エーアイ」はエー・アイ、「シーダンス2.5」の発音は「シーダンス・ニーテンゴ」。数字を「ニーテンゴ」と明瞭に読む。かぎ括弧は読み上げない。音は本人の声、控えめな息遣い、ごく小さい衣擦れと室内環境音のみ。BGM、効果音の追加、ナレーション、字幕、画面内の文字、ロゴはなし。登場人物はこの女性一人。顔、手、服、背景を途中で変形・増殖させない。
Reproduced verbatim from the original post. Never edited or translated. Everything outside this block is our own commentary.
How this prompt compares
The techniques this prompt uses are more common in UGC prompts than in the library overall:
| Technique | In UGC | Library average | Lift |
|---|---|---|---|
| handheld | 78% | 24% | 3.22x |
| zoom | 17% | 9% | 1.99x |
| natural light | 64% | 28% | 2.26x |
| soft light | 33% | 18% | 1.88x |
Across all 5,926 prompts, the techniques used here appear at: natural light 29%, handheld 24%, soft light 18%, pull-out 10%.
The 20s duration is not arbitrary: 1% of the prompts in this library that state a duration ask for exactly 20 seconds.