AI

Google Pixel 9 / 9 Pro / 9 Pro XL発表。Gemini AI推しでメモリ大増量、Proは大小2サイズ。無印9もカメラ強化 画像
スマートフォン

Google Pixel 9 / 9 Pro / 9 Pro XL発表。Gemini AI推しでメモリ大増量、Proは大小2サイズ。無印9もカメラ強化

Made by Googleイベントで、Googleが今年のPixelスマートフォンPixel 9シリーズを正式に発表しました。

Pixel 9シリーズを語るポッドキャスト第64回を本日(8月14日)正午にライブ配信 画像
AI

Pixel 9シリーズを語るポッドキャスト第64回を本日(8月14日)正午にライブ配信

テクノエッジ編集部では、「TechnoEdge-Side」(テクノエッジ・サイド)を2週に1回のペースでお届けしています。今回は、8月14日に開催されたMade by Googleイベントで発表されたGoogleの新製品などについて語ります。

動画と音声ガッチャンコでなんでもAI口パク「sync.」。リップシンクはVideo to Videoの時代に突入した(CloseBox) 画像
AI

動画と音声ガッチャンコでなんでもAI口パク「sync.」。リップシンクはVideo to Videoの時代に突入した(CloseBox)

AIリップシンクにまた大きな波が訪れました。

Apple開発の画像生成AI「マトリョーシカ拡散モデル」、iPadでリアルタイムに動画を理解するGPT-4V超えAI「MiniCPM-V 2.6」など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

Apple開発の画像生成AI「マトリョーシカ拡散モデル」、iPadでリアルタイムに動画を理解するGPT-4V超えAI「MiniCPM-V 2.6」など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第59回)では、オープンソースの動画生成AI「CogVideoX」や、動画理解でGPT-4VやClaude 3.5 Sonnetなどを精度で上回るMLLM「MiniCPM-V 2.6」を取り上げます

高性能すぎて本人証明がないと買えないAIボイチェン「Vocoflex」製品版登場。無限声色ボーカルはAI DTMに欠かせない存在に(CloseBox) 画像
AI

高性能すぎて本人証明がないと買えないAIボイチェン「Vocoflex」製品版登場。無限声色ボーカルはAI DTMに欠かせない存在に(CloseBox)

しばらくベータテスターをしていた、DreamtonicsのAIボイスチェンジャー「Vocoflex」。その製品版がついにリリースされたので、購入しました。

テレビにもGemini AI、新製品『Google TV Streamer 』発表。据置き化で大幅強化、Chromecastはディスコン 画像
Other

テレビにもGemini AI、新製品『Google TV Streamer 』発表。据置き化で大幅強化、Chromecastはディスコン

Googleがテレビと接続するセットトップボックス端末『Google TV Streamer 4K』を米国向けに発表しました。

Google、批判受けGemini AIのオリンピックCMを放送中止。なんでも相談して怒られる 画像
AI

Google、批判受けGemini AIのオリンピックCMを放送中止。なんでも相談して怒られる

Google は、批判を受けていたGemini AIのコマーシャル『Google + Team USA − Dear Sydney』を放送から取り下げました。

元Stable Diffusion開発チームによる高性能画像生成AI「FLUX.1」、Perplexity精度のオープンソース検索AI「MindSearch」など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

元Stable Diffusion開発チームによる高性能画像生成AI「FLUX.1」、Perplexity精度のオープンソース検索AI「MindSearch」など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第58回)では、先日OpenAIが発表した「SearchGPT」など、Webのタイムリーな情報と大規模言語モデルを組みわせた検索AIのオープンソースモデル「MindSearch」や、Stability AIが発表した、単一の入力画像から3Dメッシュを0.5秒で生成する「Stable Fast 3D」を取り上げます。

折りたたみAIフォンGalaxy Z Fold6 / Flip6発売。サムスン副社長にGalaxy AIの戦略を聞く(石野純也) 画像
スマートフォン

折りたたみAIフォンGalaxy Z Fold6 / Flip6発売。サムスン副社長にGalaxy AIの戦略を聞く(石野純也)

 フォルダブルスマホの「Galaxy Z Fold6」「Galaxy Z Flip6」が、7月31日に発売されました。

1枚の人物写真から動画生成できる、4つの最新AIモデルを比較。Luma、Runway、KLING、Viduの結局どれがいい?(CloseBox) 画像
AI

1枚の人物写真から動画生成できる、4つの最新AIモデルを比較。Luma、Runway、KLING、Viduの結局どれがいい?(CloseBox)

1枚の人物画像から動画を生成するAIモデルが4種類、揃いました。Luma AI Dream Machine、Runway Gen-3 Alpha、KLING、Vidu。これらを同じ人物写真(画像)、同じプロンプトで比較してみます。

OpenAI、ChatGPTが感情も読むアドバンスト音声モードを招待制テスト開始『Her』スカヨハ似ボイスは含まず 画像
AI

OpenAI、ChatGPTが感情も読むアドバンスト音声モードを招待制テスト開始『Her』スカヨハ似ボイスは含まず

OpenAIが、ChatGPTの延期していた新機能 Advanced Voice Mode を一部Plusユーザー向けに試験提供しました。

Google、生成AIがアプリUIを動的生成する「AI Generated UI」発表。ユーザー入力をLLMが把握、レイアウトもロジックも都度生成 画像
AI

Google、生成AIがアプリUIを動的生成する「AI Generated UI」発表。ユーザー入力をLLMが把握、レイアウトもロジックも都度生成

基本的に、アプリケーションのユーザーインターエイス(UI)は開発時に設計され実装されて、その実装通りに実行時に表示されるものです。

高性能動画生成AI「Vidu」の実力を試す。Character to Videoとは何か。KLINGやRunwayとはどこが違うのか(CloseBox) 画像
AI

高性能動画生成AI「Vidu」の実力を試す。Character to Videoとは何か。KLINGやRunwayとはどこが違うのか(CloseBox)

KLINGのサブスクリプションが開始されたばかりですが、翌日の7月31日に早くもライバルが登場しました。同じく中国の動画生成AIサービスで、「Vidu」というものです。といってもぽっと出ではなく、4月末辺りからSoraクラスの動画生成AIとして発表され、注目はされていました。このViduが一般利用可能になったのです。

Runway Gen-3でImage to Videoとリップシンク生成可能に。これは現時点最強のAI動画モデルなのか?(CloseBox) 画像
AI

Runway Gen-3でImage to Videoとリップシンク生成可能に。これは現時点最強のAI動画モデルなのか?(CloseBox)

7月30日、動画生成AIサービスの老舗であるRunwayが、最新モデルであるGen-3 AlphaでImage to Videoを使えるようにしました。

生成AIグラビアをグラビアカメラマンが作るとどうなる?第29回:知ってるとちょっと便利かも?なカスタムNode・ワークフロー特集(西川和久) 画像
AI

生成AIグラビアをグラビアカメラマンが作るとどうなる?第29回:知ってるとちょっと便利かも?なカスタムNode・ワークフロー特集(西川和久)

1つ何役?controlnet-union-sdxl-1.0

世界一斉ブルースクリーン事件などを語るポッドキャスト第63回を本日(7月29日)正午にライブ配信 画像
AI

世界一斉ブルースクリーン事件などを語るポッドキャスト第63回を本日(7月29日)正午にライブ配信

テクノエッジ編集部では、「TechnoEdge-Side」(テクノエッジ・サイド)を2週に1回のペースでお届けしています。その第62回放送を、本日(7月29日)正午(12時)に、YouTubeで行います。

AIが量産するデータで何度も学習するAIは「モデル崩壊」する研究結果、SD級の大型画像生成AIを「約29万円」「2.6日」の高コスパで訓練できるSonyAI開発「MicroDiT」など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

AIが量産するデータで何度も学習するAIは「モデル崩壊」する研究結果、SD級の大型画像生成AIを「約29万円」「2.6日」の高コスパで訓練できるSonyAI開発「MicroDiT」など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第57回)では、生成AIが生成したコンテンツを生成AIが学習し続けると性能低下が見られ、モデル崩壊が起きるという研究報告を取り上げます。また、Sony AIが大型の画像生成AI(11.6億パラメータ)の訓練を8台のNVIDIA H100 GPUを使用してわずか2.6日で完了し、しかもそれが約29万円という高いコストパフォーマンスを達成した手法「MicroDiT」をご紹介します。

AI作曲UdioとChatGPTで甦る昭和歌謡。1973年のヒット曲とカラオケ本人映像をAIで捏造した(CloseBox) 画像
AI

AI作曲UdioとChatGPTで甦る昭和歌謡。1973年のヒット曲とカラオケ本人映像をAIで捏造した(CloseBox)

音質が爆上がりして長さも2分10秒と完成曲が作りやすくなったUdio。1970年代初期のバラード(ユーミンとか)を作ろうと思ってやってみたら、なぜか昭和歌謡っぽいものを連発してきました。

OpenAI、独自検索エンジン「SearchGPT」公開。招待制の期間限定試作、ChatGPTと統合へ 画像
AI

OpenAI、独自検索エンジン「SearchGPT」公開。招待制の期間限定試作、ChatGPTと統合へ

OpenAIが、うわさの独自検索エンジン「SearchGPT Prototype」の試験運用を開始しました。

『WWDC24報告会&テクノエッジ パーティー』イベントリポート。鹿島OPSODIS 1スピーカーの開発秘話も 画像
オーディオ

『WWDC24報告会&テクノエッジ パーティー』イベントリポート。鹿島OPSODIS 1スピーカーの開発秘話も

Appleは6月11日に、年次開発者会議「WWDC24(Worldwide Developers Conference 2024)」を開催しました。

AI作曲サービスのSunoとUdioが相次いでステム分離機能搭載。Udioは待望の2分超え生成が可能に(CloseBox) 画像
AI

AI作曲サービスのSunoとUdioが相次いでステム分離機能搭載。Udioは待望の2分超え生成が可能に(CloseBox)

AI作曲サービスのSunoに、ステム分離機能が追加されました。翌日、Udioがステム分離を含む大幅な機能強化。

アジア系に強い新世代動画生成AI「KLING」がやってきたので試した。実用性高く無料生成も可能、静止画KOLORSも使える(CloseBox) 画像
AI

アジア系に強い新世代動画生成AI「KLING」がやってきたので試した。実用性高く無料生成も可能、静止画KOLORSも使える(CloseBox)

Soraに匹敵する高品質の動画生成AIとして注目を浴びながら、中国の携帯電話番号が必須だったことから世界中の羨望を集めていた、KLINGが一般ユーザーも利用可能になりました。

無限ループ動画が簡単にできる。Luma AIのDream Machineが進化してまた楽しみが増えた(CloseBox) 画像
AI

無限ループ動画が簡単にできる。Luma AIのDream Machineが進化してまた楽しみが増えた(CloseBox)

ポストSoraというか、ビフォーSoraというか、新世代の動画生成AIも老舗であるRunway Gen-3登場以降、目新しいニュースがなかったのですが、Luma AIのDream Machineがちょっとした新機能を追加しました。

AIとの対話を長期記録してLLMの応答をパーソナライズする「Mem0」、オープンソースLLMを商用モデル精度で使用する方法など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

AIとの対話を長期記録してLLMの応答をパーソナライズする「Mem0」、オープンソースLLMを商用モデル精度で使用する方法など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第56回)では、AIとユーザーの対話内容を長期記録し、LLMの応答をそのユーザーにパーソナライズしていくメモリ機能「Mem0」や、音声の理解に優れている大規模言語モデル「Qwen2-Audio」などを取り上げます。

日本語は外国人話者にとって難しすぎるので、新しい簡易日本語「Japhalbet」をAIに作ってもらった(CloseBox) 画像
AI

日本語は外国人話者にとって難しすぎるので、新しい簡易日本語「Japhalbet」をAIに作ってもらった(CloseBox)

AI研究家の清水亮さんが面白いことをやっています。「Lispっぽい記法で書けるけど他の言語に慣れた人にも使える言語」の処理系だそうです。

世界的にWindows死のブルースクリーンが多発する中、Suno AIの歌詞・ビデオ修正機能を試した(CloseBox) 画像
AI

世界的にWindows死のブルースクリーンが多発する中、Suno AIの歌詞・ビデオ修正機能を試した(CloseBox)

Windows用エンタープライズセキュリティソフトのCrowdStrikeが原因でWindowsが世界的にブルースクリーンが多発している問題が起きているようです。

画像生成AI実技をオンラインで。「Stable Diffusion」の基本から最新技術まで学べる。グラビアカメラマンが教える、生成AIグラビア実践ワークショップ(第2期第4回)を7月24日開催。参加者募集します 画像
AI

画像生成AI実技をオンラインで。「Stable Diffusion」の基本から最新技術まで学べる。グラビアカメラマンが教える、生成AIグラビア実践ワークショップ(第2期第4回)を7月24日開催。参加者募集します

人気連載「生成AIグラビアをグラビアカメラマンが作るとどうなる?」の著者である西川和久さんを講師に迎えた、生成AIグラビアワークショップの第2期第4回を7月24日に開催いたします。なお、今回お申し込みいただいた方は、前回分の動画アーカイブを視聴いただけます。

生成AIグラビアをグラビアカメラマンが作るとどうなる?第28回:SD3 Mediumその後と、KolorsなどポストSD的なtxt2imgモデルを試す(西川和久) 画像
AI

生成AIグラビアをグラビアカメラマンが作るとどうなる?第28回:SD3 Mediumその後と、KolorsなどポストSD的なtxt2imgモデルを試す(西川和久)

SD3 Mediumその後

Insta360夏セールで360度カメラX3や超小型カメラが特価、おすすめ解説。AIトラッキングWebカメラ Insta360 Linkも 画像
カメラ

Insta360夏セールで360度カメラX3や超小型カメラが特価、おすすめ解説。AIトラッキングWebカメラ Insta360 Linkも

360度カメラや小型アクションカメラで人気のInsta360が、公式ストアとAmazonで夏セールを実施中です。

漫画の1コマから続く20コマ以上を作り出す物語生成AI「SEED-Story」、イラストの制作過程動画を生成するAI「PaintsUndo」など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

漫画の1コマから続く20コマ以上を作り出す物語生成AI「SEED-Story」、イラストの制作過程動画を生成するAI「PaintsUndo」など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第55回)では、1枚の完成したイラスト絵を入力に、そのイラストの制作過程のタイムラプス動画を生成する「PaintsUndo」や、画像とテキストをペアにした1コマを入力に、続きの物語を生成する「SEED-Story」などを取り上げます。

『折りたたみAIフォン』Galaxy Z Fold6は7月31日発売、約25万円から。歴代最薄最軽量、冷却強化で大画面ゲーミング推し 画像
スマートフォン

『折りたたみAIフォン』Galaxy Z Fold6は7月31日発売、約25万円から。歴代最薄最軽量、冷却強化で大画面ゲーミング推し

パリで開催中のイベント Galaxy Unpacked で、サムスンが今年の折りたたみスマホ2機種と新型イヤホン、ウォッチ、そして新たなカテゴリ「Galaxy Ring」を正式発表しました。

Apple Intelligence対抗Google AIを搭載してカメラバーは丸く? 2カ月前倒しの8月13日「Made by Google」イベントで何が発表されるのか予想(Google Tales) 画像
スマートフォン

Apple Intelligence対抗Google AIを搭載してカメラバーは丸く? 2カ月前倒しの8月13日「Made by Google」イベントで何が発表されるのか予想(Google Tales)

Googleは毎年、5月に開発者会議「Google I/O」を、10月にハードウェア発表イベント「Made by Google」を開催してきました。ところが今年は後者を8月13日に開催します。

AIプログラミングにリミックス文化が? Claude Artifacts生成物がページ公開できて自由な改変も可能に(CloseBox) 画像
AI

AIプログラミングにリミックス文化が? Claude Artifacts生成物がページ公開できて自由な改変も可能に(CloseBox)

Claude ArtifactsにPublish Artifact、Remix Artifactという新機能が追加されました。

Insta360 Flow Pro発表、iPhoneをAI自動追従カメラにするジンバル+三脚。Apple DockKitで対応アプリと用途が大幅拡大 画像
カメラ

Insta360 Flow Pro発表、iPhoneをAI自動追従カメラにするジンバル+三脚。Apple DockKitで対応アプリと用途が大幅拡大

360度カメラやアクションカメラのInsta360が、スマホ用ジンバルの新製品 Insta 360 Flow Proを発表しました。

万能系Artifacts登場。「Poe Previews」ならGeminiもGPT-4もClaudeもAI共同開発者にできる(CloseBox) 画像
AI

万能系Artifacts登場。「Poe Previews」ならGeminiもGPT-4もClaudeもAI共同開発者にできる(CloseBox)

このところプログラミングの楽しみを覚えて毎日Claude ArtifactsとChatGPT Artifactsで遊んでいる筆者ですが、またまた新しいツールに出会ってしまいました。

他人の顔でYouTuber? 写真内の顔を思うように動かして話をさせるAI「LivePortrait」を動画生成AI「KLING」開発元が発表など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

他人の顔でYouTuber? 写真内の顔を思うように動かして話をさせるAI「LivePortrait」を動画生成AI「KLING」開発元が発表など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第54回)では、KLINGを開発した快手が、画像内のキャラクターの顔を自在に動かす技術「LivePortrait」を発表しました。

ChatGPT Artifactsができた? GPT-4oでもClaudeみたいな楽しいプロンプト開発ができるのだ(CloseBox) 画像
AI

ChatGPT Artifactsができた? GPT-4oでもClaudeみたいな楽しいプロンプト開発ができるのだ(CloseBox)

大規模言語モデルのClaudeが送り出した新機能、Artifactsを使った記事が思いのほか好評のようですが、問題が一つ。使用量制限がかかってしまい、次のアクションまで数時間待たされることが頻発しているのです。

45年前の初代ウォークマンからiPod、iPhoneと進化した音楽リスニング体験。Suno AI公式アプリの登場でどう変わるか(CloseBox) 画像
AI

45年前の初代ウォークマンからiPod、iPhoneと進化した音楽リスニング体験。Suno AI公式アプリの登場でどう変わるか(CloseBox)

45年前に発売された革命的デバイス、ウォークマン。そのアニバーサリーにふさわしいエポックメイキングなアプリが登場しました。

生成AIグラビアをグラビアカメラマンが作るとどうなる?第27回:SD3 Mediumリリース!Part2(西川和久) 画像
AI

生成AIグラビアをグラビアカメラマンが作るとどうなる?第27回:SD3 Mediumリリース!Part2(西川和久)

前回に引き続きStable Diffusion 3 Mediumの話

現実と超現実を動画AIが描く「Gen-3 Alpha」にできること、できないこと。老舗Runwayが投入したSora世代の高性能動画生成AI(CloseBox) 画像
AI

現実と超現実を動画AIが描く「Gen-3 Alpha」にできること、できないこと。老舗Runwayが投入したSora世代の高性能動画生成AI(CloseBox)

動画生成AIでは老舗のRunwayがGen-3 Alphaを一般公開しました。使えるユーザーはStandardプラン以上。筆者はそれに該当しているので使ってみました。

ドラムマシン、シンセ、サンプラーがわずか数分で完成。非プログラマーなのにClaude + Artifactsのプロンプト開発が楽しすぎて限度超える(CloseBox) 画像
AI

ドラムマシン、シンセ、サンプラーがわずか数分で完成。非プログラマーなのにClaude + Artifactsのプロンプト開発が楽しすぎて限度超える(CloseBox)

ノンプログラマーな自分が、大規模言語モデル(LLM)の助力で、初めてまともに動くプログラムを完成させることができました。

AI生成の動画を“5倍以上長く”する拡張モデル「ExVideo」、無音動画に“それっぽい音”を挿入できる「FoleyCrafter」など生成AI技術5つを解説(生成AIウィークリー) 画像
AI

AI生成の動画を“5倍以上長く”する拡張モデル「ExVideo」、無音動画に“それっぽい音”を挿入できる「FoleyCrafter」など生成AI技術5つを解説(生成AIウィークリー)

この1週間の気になる生成AI技術をピックアップして解説する「生成AIウィークリー」(第53回)では、生成する動画時間の延長や無音ビデオに適した音を生成するなど動画AIに関する内容が盛りだくさんです。