Art is a concentrated form of intention——
芸術とは、意図の凝縮された形である。
これがTed Chiang氏が定義する「Art」だと、彼の講演で知った。
先は、Ted Chiang氏の講演「The Incompatibility Between Generative AI and Art」を見ました。
確かに、生成AIを使った創作は、完全に自動生成に任せる場合を除けば、最終的に人間が自分の意図を何度も注入し、選択を重ねるプロセスです。AIはそれを劇的に加速し、拡大してくれるツールに過ぎない。
講演でも指摘されていたように、優れた創作ツールは創作者により多くの「degrees of freedom(制御の自由度)」を与えるべきで、その点では現時点のAIはまだ十分とは言えないのかもしれません。
それでも、私はそうは思いません。
実際にこのプロセスを自ら繰り返し操作してみなければ、たとえその分野でどれだけ権威があったとしても、判断はどうしても表層にとどまりがちだ、と。
*画像は以上のテキストをそのままGPTImage2に投げって、「AIとして君はどう思う?」って質問したら、出力された画像だ
長いエロ動画から、オーガズムを含む10秒間を見つけて、ComfyUIの動画生成用参照素材として切り出す仕組みを、ここまでほぼQwen3.8 27Bと作ってきた。
手作業で大量の動画を確認するのは大変だし、発情してしまう。そこで、AIに動画を見せて「どこがオーガズムか」と聞いても、まだ正確には判断できない。
試しにとあるAVモデルさんのエロ動画の
音声・映像の動き・動きのフリーズのスコアを眺めてたら、
オーガズムの瞬間の特徴として次のような傾向があった
A. 100〜1500Hzの喘ぎ声→その後の急減衰
B. フレーム間の映像変化量急増
C. freeze、コマ止め、ディゾルブなどのソフト遷移
試しにこれらから条件を決めたスクリプトを書かせて、オーガズム候補の位置を探したところ、結構ビクビクなってる感じのところが溜めれたからまあ良いんかなと。
この後は、それを自動化して、24fps・H3規定フレーム数へ整形して、そのままComfyUIへ投入できるようにする。
もう少しデータが集まったら、絶頂の瞬間とそうでない瞬間の数値データを学習させ、CatBoostくらいの軽量な機械学習で自動的にカットを切り出せるようにしたい。
ただ、オーガズム時の声や動きは人によって異なる。最終的にはAVモデルごとに学習モデルを作るか、個人差を補正する仕組みが必要になるとは思う。そこまではQwen3.8 27B でいけたら面白い。
グラフのGTが絶頂の瞬間。
A B C 全部で絶頂かと言われるとそうでもない。
この辺のパターンが人間だと良くわからない→分類器作ろ。
この発想は、投資の売買シグナルの選別によく似てると思う。