AI作曲サービスSunoのUIがガラリと変わったので、使い方をまとめてみました。
Suno短期連載第3弾。Suno + ChatGPT + Stable Diffusionを連携させてAI楽曲を作る試みです。
生成AIは技術の進歩/進化が凄まじいペースで数ヶ月前はもうかなり古い話になることもあり、今回はこれまでの13回分をまとめてみたい。
テスラはX(Twitter)でヒト型ロボット「Optimus」の第2世代(Gen 2)となるバージョンを公開しました。紹介動画では、前世代バージョンよりも立居振舞が自然な雰囲気に近づいたように見えます。
Sunoで作った楽曲を音源分離し、再構築して歌ってみました。そこで、Suno以降の音楽制作と音楽体験のあり方について考えてみました。
Inter BEE 2023で取材した中から、未来のトレンドを読み取ってみた。
感動できるボーカル曲をAIがほぼ一発で生成できるようになりました。
今週は重要論文が多くて6本です。画像の深度情報を推定する技術を大幅に進化させた「Marigold」などの生成AIの最新情報をお届けします。
動画がすごすぎると話題を呼んだGoogle Gemini Ultraですが……。
Metaは12月6日(現地時間)、同社の画像生成AI「Imagine」のウェブ版(imagine.meta.com)を公開しました。サイトは日本語化されていますが、残念ながらいまのところ利用できるのは米国のみとなっています。
人気連載「生成AIグラビアをグラビアカメラマンが作るとどうなる?」の著者である西川和久さんを講師に迎えた、生成AIグラビアワークショップの第3回を12月21日に開催いたします。なお、今回お申し込みいただいた方は、第2回分の動画アーカイブを視聴いただけます。
Googleは12月6日(現地時間)、新しいAIモデル「Gemini」を発表しました。用途に応じてUltra、Pro、Nanoという3つのバージョンが用意されており、その中でモバイル機器向けとなるGemini NanoをPixel 8 Proに展開することも発表されています。
日本時間12月7日、Googleは新開発のAIモデル「Gemini」を発表しました。モバイル機器からデータセンターまで、あらゆる用途に対応すべく、Gemini Ultra、Gemini Pro、Gemini Nanoの3種類を用意しています。
生成AIの出力画像を元にCGで作った新聞っぽいフェイク画像をXに投稿したところ、想像以上の反響がありました。気軽な実験のつもりで説明も雑過ぎたため、伝わりにくかったり誤解されたりした部分もあるようです。どのように、なぜ作ったのか補足します。
手のひらに乗る立体視ディスプレイ「Looking Glass Go」を2台買ってしまいました。その理由は……。
Microsoftは12月4日(現地時間)、国際障害者デー(12月3日)を記念して、スマートフォンのカメラを向けたものを音声で説明するアプリ「Seeing AI」のAndroid版をリリースしました。
先週大きな話題となった、画像内のキャラクターや写真内の人物を骨格動画に応じて動かせる「Animate Anyone」など5本の生成AI論文を紹介。
Google DeepMindや複数の大学の研究者からなるチームが、AI企業に対し、単純な攻撃がプライバシー関連の問題を起こす可能性があるとして、大規模言語モデル(LLM)をリリースする前に内部や第三者による安全性テストを実施するよう求めています。
Amazon Web Services(AWS)は、ラスベガスで開催中のイベント「AWS re:Invent 2023」の基調講演で、AIのトレーニングに最適化した独自プロセッサ「AWS Trainium2」を発表しました。
米アマゾンは11月28日、企業向けのAIチャットボット「Q」を発表しました。AWSの機能を熟知しており、関連サービスを利用している顧客が問題に遭遇した際に、自然言語で解決策を問い合わせることが可能になります。
米国政府はAIや機械学習に使われるGPUにつき、中国への輸出規制を強化しつつあります。その範囲は次第に拡大し、ついにNVIDIAの最新GPUであるRTX 4090にまで及びました。本来はゲーム用ではありますが、非常に高い演算能力を誇り、当然AI用途にも転用できるためです。
元アップル社員が開発し、OpenAIのサム・アルトマンも出資したと話題になっていたAIウェアラブルがついに発売(米国のみ)。これを購入できた五島正浩さんに、購入時の様子をレポートしてもらいました。
Inter BEE 2023とAdobe MAXを取材した小寺信良さんが感じた、業界の変化とAIについて。
発表以来大きな話題となっている、Stability AIの動画生成AIモデルなど、5本の生成AI論文を解説。
GoogleはAIチャットボット「Bard」をアップデートし、YouTube動画を理解できる最初の一歩を踏み出したと発表しました。
先週末にOpenAIから解任された、共同創業者のサム・アルトマン氏がCEOとして復帰することが決まりました。
OpenAIは元CEOサム・アルトマン氏の去就をめぐり大変なことになっているさなか、ChatGPTモバイルアプリの音声会話機能を無料ユーザーも利用可能にしたと発表しました。
マイクロソフトの最高技術責任者(CTO)ケヴィン・スコット氏はOpenAIの従業員に対し、もしマイクロソフトに移るのであれば、現在のOpenAIで得ているのと同額の報酬で雇用する考えを示しました。
OpenAI従業員の大半は、取締役会に宛てた書簡のなかで、解任した元CEOのサム・アルトマン氏が復帰しないのであればOpenAIを退職する意向を示しました。一方アルトマン氏は未だOpenAIに戻る可能性を捨てきってはいない様子であることが新たに伝えられています。
マイクロソフトのサティア・ナデラCEOによる投稿で、OpenAIお家騒動は一件落着となりました。
OpenAIの共同創設者兼取締役のイリヤ・サツケヴァー氏は、解任したCEOサム・アルトマン氏は協議の末OpenAIに戻らず、復帰の予定がないことを明らかにしました。
第9回にFooocus-MREを使ってControlNetをご紹介したが、一般的なAUTOMATIC1111での説明はまだだったので、改めて今回と次回で行いたい。
OpenAIのCEOを追われたサム・アルトマン氏が「これ(OpenAIのゲストタグ)を着けるのはこれが最初で最後」という写真をXに投稿しました。
生成AIの最新トレンドを追いかける連載。今回は入力テキストを実写アバターに話させるツール、擬人化キャラの外見や性格を文章で作り出す技術など重要論文5本を解説します。
OpenAIは、この週末に解任したサム・アルトマン氏に対して、CEOに復帰することを求めて協議しています。
ChatGPTやDALL・E等の生成AIサービスで知られるOpenAI社が、CEOサム・アルトマン氏の退社を発表しました。
日本の文化・アートを日本語の入力で高品質に出力できる画像生成AIが、Stability AIから公開されました。
マイクロソフトは開催中の年次イベント「Microsoft Ignite 2023」で、同社のAIサービスであるCopilotのカスタマイズやプラグイン開発、ワークフローの設定、データソースとの接続などを含むさまざまな開発を可能にするローコード開発ツール「Copilot Studio」を発表しました。
Googleは、写真ライブラリーの中にあるほとんど同じ写真を整理するための新しいAI機能を発表しました。
マイクロソフトはこれまで「Bing Chat」および企業向けに「Bing Chat Enterprise」の呼称で提供してきたAIサービスを「Copilot」にリブランディングし、同社のAIサービス全体の体験を「Microsoft Copilot」で統一します。
人気連載「生成AIグラビアをグラビアカメラマンが作るとどうなる?」の著者である西川和久さんを講師に迎えた、生成AIグラビアワークショップの第2回を11月22日に開催いたします。
伝説的歌手であるエディット・ピアフが遺した声を元にしたAIボイスによりナレーションが行われることが発表されました。