正在加载视频...

视频加载失败

【注目】 JimakuAIが簡単に日本語字幕を生成できる「JimakuAI for 日本語」を提供開始 独自のアルゴリズムを使用し、文脈を理解した高精度な文字起こしが可能 これまで手作業だった動画の文字起こしから翻訳などを自動化 高精度で音声のテキスト化を効率的にできます 無料トライアル実施中 続く>>

156,060 次观看 • 2 年前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

動画編集者でこれ使ってない人正直100万円くらい損してるよ PremierやCapcutで文字起こし便利だけど改行めちゃくちゃで手修正の時間意外とかかる AI知識ないけどテロップは時短したいっていうワガママな人はManusでこのプロンプトを実行してみて ーーーーー ## 指示 動画編集の字幕作成処理をします。添付の動画に対して下記の『処理手順』に従って順番に処理を実行してSRT形式のファイルを作成してください。各種処理過程では中間データとして temp.json を作成してそこに中間出力データを入れて進めること。 ## 処理手順 ### STEP1:音声抽出 ・添付動画を受け取ったら、 ffmpeg を使って音声ファイル(wav形式)を取得する。 ・後段ではこの音声ファイルを使って文字起こし(ASR)の処理を行う ### STEP2:音声文字起こし ・取得した音声ファイル(wav形式)をもとにWhisperで音声文字起こしをする。 文字単位のタイムスタンプ付きで取得すること ・取得したテキスト情報は temp.json に格納すること ### STEP3:テキストの分割整形 ・文字起こししたテキスト全体に対して BudouX を使って視覚的な見やすさを考慮したトークンを作成する ・このデータに対して動的計画法を使って字幕の表示最適化を行う。1行の字幕にしてください。1テロップでは文字数は13文字前後にしてください。 ・文字起こし時に取得したタイムスタンプ情報を使って各字幕の[start, end]のタイミングは実際の時間情報をもとにセットしてください ### STEP4:セルフレビュー 作成した字幕テロップの整形データを見てセルフレビューをしてください。下記の項目でチェックすること: ・意味的に崩れてないか?:日本語でそのテロップを見た時に明らかに中途半端な位置で字幕切り変えが発生してないかを確認 ・文字数は適切か?:1行あたり13文字程度の分量になっているかを確認 ・タイムスタンプは維持できているか?:元の文字起こしデータのタイムスタンプとずれた情報をセットしていないかを確認 ### STEP5:字幕ファイル(SRT)作成 作成したテロップ情報をSRT形式で成果物として出力してください ## 注意点 ・必ず各ステップで処理が正しく進んでいるかをセルフチェックすること ・特に字幕整形処理は、意味的に不自然な区切りで視認性を下げたテロップになってないかを逐一チェックすること ーーーーー 脳死で丸コピでOK 編集ツールにインポートもできるから超絶時短が一瞬でできるの神すぎる

ひかる|AGIにオールイン

117,948 次观看 • 9 个月前

【速報】中国Alibabaがマルチモーダルで勝負を仕掛けてきた。テキスト・画像・音声・動画を全て理解して音声も生成できる「Qwen3-Omni」を完全オープンソース化。何が凄いのか、具体的に解説していきます。 ①音声生成できる唯一のオープンソースモデル MetaのLlama 4、GoogleのGemma 3、OpenAIのGPT-OSS、全部音声生成はできない。 でもQwen3-Omniだけはテキスト・画像・音声・動画を理解して、さらに音声でも返答できる。 つまり「動画見せて音声で説明して」「リアルタイム音声会話」が無料でできる唯一のオープンソース。これがApache 2.0ライセンスで商用利用OK、完全無料ってヤバすぎる。 ②実力テストで有料モデルと互角 AIの実力を測る「ベンチマーク」でQwen3-Omniが驚異的な結果を出してる。36のベンチマークのうち22で最高スコア、32でオープンソース1位を記録。 しかも動作に必要なのは30億パラメータだけ。他のモデルが数千億必要なのに。つまり、普通のPCでも動くサイズで、巨大サーバー必要なAIと同等の性能ってこと。 ③動画と音声の同期技術がヤバい 「Thinker-Talker」っていう新技術で、考える部分と話す部分を分離。これで0.234秒(まばたきする間)で音声返答できるようになった。さらに「TMRoPE」技術で動画と音声のタイムスタンプを完璧に同期。 動画見せて「これを日本語吹き替えして」って言ったら、音声タイミングを合わせて吹き替えできるレベル。 ④音声AIビジネスが爆発的に広がる OpenAIのRealtime APIは音声会話できるけど、100万トークンで入力40ドル、出力80ドルかかる。 でもQwen3-Omniなら同じような機能を自社サーバーで無制限に使える。これで何ができるか? AI Vtuberの音声をリアルタイムで生成する配信。バーチャルAIインフルエンサーが動画を見ながら実況。視聴者の動画に多言語音声を自動でつける機能も、タイミングを合わせて生成できる。 さらに、オンライン語学学習アプリ、AIカスタマーサポート、音声ガイドアプリ。 全部APIコストゼロで、リアルタイム音声対話が可能になる。(誰か精度検証お願いしますw) というわけで、音声対話AIを開発するなら、Qwen3-Omni試さない理由がない。AI Vtuberから動画翻訳まで、音声生成できる唯一のオープンソースAIだぞ。

Tom | ドバイで生成AIやってる人

46,269 次观看 • 11 个月前

🤯 Sora2 + n8nで、無限にインフルエンサーが自社商品を宣伝してくれます... 僕がランチを食べている間に、このAIエージェントは20パターンのインフルエンサー動画広告を生成していました... - 商品画像を1枚アップ - AIが画像を分析、最適なシナリオを複数生成 - AIインフルエンサーが日本語で話す動画を自動生成 - 完成動画をGoogle Driveに自動保存 すべてこのAIエージェントが全自動で処理。 広告代理店が1本の動画を作る間に、 こっちは100本のABテスト用動画を自動で作れます。 もう高い費用を払って広告代理店に依頼する必要はありません。 ターゲットに合ったインフルエンサー広告を無限に生成できます。 これはただの動画生成ツールではありません。 あなたの商品を24時間宣伝し続ける、無尽蔵のAI営業部隊です。 今回、条件を満たした方限定で、 この「AIインフルエンサー動画広告 全自動エージェント」を無料で配布します。 今すぐ使える完成品です。 ---------- 【受け取り条件】 ✅いいね & この投稿をリポスト ✅「動画広告」とリプライ ※ DMが送れないので、@taiki_16_k をフォロー必須 ---------- 条件を満たした方限定で、DMで送ります! 今から72時間限定です!

神崎タイキ|Claude Code × 動画編集

59,770 次观看 • 10 个月前