米国のChatGPT Proユーザーのみに開放されているOpenAIのAIエージェント「Operator」を試してみました。
OpenAIは1月23日(米国時間)、ユーザーの代わりにブラウザを操作してタスクを実行するAIエージェント「Operator」を発表しました。
サムスンがGalaxy初のスマートリング製品 Galaxy Ring の日本向け販売を発表しました。
開催中の Galaxy Unpacked イベントで、サムスンがスマートフォンのフラッグシップモデル Galaxy S25シリーズを発表しました。
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する「生成AIウィークリー」(第79回)では、自分の動きに応じてキャラクターの顔をリアルタイムに動かせる動画生成AI「RAIN」、400万トークンを処理できる大規模言語モデル「MiniMax-01」を取り上げます。
人気連載「生成AIグラビアをグラビアカメラマンが作るとどうなる?」の著者である西川和久さんを講師に迎えた、生成AIグラビアワークショップの第3期第3回を1月22日に開催いたします。
世界初のAIチャットボット「ELIZA」(イライザ)を60年ぶりに復活させた研究「ELIZA Reanimated: The world’s first chatbot restored on the world’s first time sharing system」
生成AI画像で一番気になるのは生成時間。SD 1.5/SDXLはRTX 30系/40系を使えば比較的速いものの、FLUX.1 [dev] になって随分時間がかかるようになってしまった。が、LoRAを使って高速化する技術がある。筆者お気に入りであるFLUX.1-Turbo-Alpha を紹介しよう。
毎月13万円をかけている生成AIサブスクですが、特に動画方面で、ちょこちょことアップデートがされています。今回はその辺で気になるところを試してみます。
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する「生成AIウィークリー」(第78回)では、自律AIたちが研究プロセス全般を自動で実行するモデル「Agent Laboratory」、ロボットや自動運転車などの物理AI向けデジタル環境学習プラットフォーム「Cosmos」を取り上げます。
今回は、AIがフリーランス(オンライン)の各仕事にどのような影響を及ぼし、職種による違いを分析した論文「AI and Freelancers: Has the Inflection Point Arrived?」に注目します。
米アリゾナ州スコッツデールのある駐車場で、Waymoの自動運転タクシーが駐車場をぐるぐると回り始め、乗客が危うく飛行機に乗り遅れそうになる問題が発生しました。
また欲しいものが出てしまいました。Mac miniっぽいスーパーコンピュータ。
ラスベガスで開催中のCES 2025基調講演で、NVIDIAのジェンスン・フアンCEOが次世代GPU GeForce RTX 50シリーズを正式に発表しました。
サムスンは、2025年最初のGalaxy Unpackedイベントを1月22日(日本時間23日午前3時)より開催すると発表しました。
2025年1月6日朝に見た夢の続きをChatGPT o1 pro modeに短編スタイルで書いてもらいました。
AI小説の執筆、だいぶ慣れてきました。そして、browser-useというソフトが面白いです。
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する「生成AIウィークリー」(第77回)では、テキストから物理シミュレーションを生成するAIを内蔵した高速物理エンジン「Genesis」、GPT-4oやClaude-3.5-Sonnetに匹敵するオープンソースの大規模言語モデル「DeepSeek-V3」を取り上げます。
今回は、AI教師が囲碁を生徒に指導すると学習効果はどうなるかを調査した研究論文「Can Artificial Intelligence Improve Gender Equality? Evidence from a Natural Experiment」に注目します。
年末ということで、生成AI画像の2024年をバックナンバー見つつ、ざっくりおさらいしてみたい。
みなさん、AIサブスクしてますか?
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する「生成AIウィークリー」(第76回)では、アニメの自動彩色と中間フレームを生成できるAIモデル「AniDoc」と、Metaの動画理解AIモデル「Apollo」をご紹介します。
すでに2024年のベストバイとして、オープンイヤーイヤホンの「nwm DOTS」を挙げた筆者ですが、実はもう一つ、ベストバイとして挙げたいデバイスがあります。それがウェアラブルAIメモリーカプセル「PLAUD NotePin」です。
最近、AIに小説を書いてもらっています。
人気連載「生成AIグラビアをグラビアカメラマンが作るとどうなる?」の著者である西川和久さんを講師に迎えた、生成AIグラビアワークショップの第3期第2回を12月26日に開催いたします。
OpenAIが最近発表したAIモデル「o3」と汎用人工知能(AGI)について、AGIの性能を評価するベンチマーク「ARC-AGI」の開発者フランソワ・ショレ氏(Googleの研究者)が考察した記事に注目します。
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する「生成AIウィークリー」(第75回)では、Microsoftの新しい言語モデル「Phi-4」や、カメラ越しに映る現実をリアルタイムに理解するAIモデル「IXC2.5-OL」を取り上げます。
VOCALOIDが発売から20年を迎え、ヤマハの特設ページが公開されました。継続的にVOCALOIDの新技術を試して記事にしていた筆者もお祝いのメッセージを書いています。
FLUX.1 Toolsとは?
今年2024年は生成AIの、特に動画において画期的な進歩が継続して行われた年でした。この連載でもずっと追いかけてきたテーマでもあるので、特に動画生成AIについて、自分が作った動画で振り返ります。
128GB M4 Max MacBook Pro、予約しただけで記事を書いた私ですが、ようやく届いたので、いろいろとやりたかったことを試しています。
AIたちが「答えが分からない」と自身の無知を認識できるかを検証した論文「The Impossible Test: A 2024 Unsolvable Dataset and A Chance for an AGI Quiz」を取り上げます。
現在大田区役所では、東京都の次世代通信技術活用型スタートアップ支援事業のもと、avatarinとともにローカル5Gを含む次世代通信技術を活用した実証実験を行っています。
自分の半生を描いたドキュメンタリー作品がYouTubeで公開されます。
Googleは、人間がタスクを与えると自律的に実装計画を立ててコードの生成や変更、バグフィクスなどを実行してくれるAIエージェント「Jules」を発表しました。
Googleが新OS『Android XR』を発表しました。
OpenAIが12日間、新機能を発表する「12 Days of OpenAI」、6日目はChatGPTのAdvanced Voice Mode(高度な音声)の新機能について。
Apple Intelligenceはまだ日本語では使えませんが、英語モードにすれば利用可能です。本日アップデートされたiOS 18.2ではChatGPTとの統合に加え、待望のAI画像生成機能「Image Playground」が追加されました。その機能を試してみます。
OpenAIは、ChatGPTの新しい有料プラン「ChatGPT Pro」を発表しました。価格は月額200ドルで、最高レベルの「OpenAI o1」を含むすべてのモデルを無制限で使用することができます。
人気のため一時はアカウント作成ができない状態だったSoraですが、ようやくアカウントを作成し、ログインできたので試してみました。
OpenAIの動画生成AI「Sora」がついに公開されました。
中国の南京大学やドイツのMax Planck Institute for the Science of Lightに所属する研究者らが、AIシステムを用いて量子もつれの新しい生成方法を発見した論文「Entangling Independent Particles by Path Identity」を解説します。