アメリカのIT大手グーグルは、動画やテキストなどを組み合わせて入力し動画を生成できる新たなAIモデル「Gemini Omni」など新たなサービスを発表しました。
鏡越しに自身を撮影する男性。鏡を触ると、突然、男性の姿がぬいぐるみのように。
グーグルは19日、開発者向けイベントの「グーグルI/O」を開き、様々な新サービスを発表しました。
「Gemini Omni」は、動画や画像、テキストなどを自由に組み合わせて入力し、動画を生成することができます。現実世界の物理法則を理解し、撮影された動画から物体を消したり、画角を変えたりすることもできます。
また、AIエージェントサービス「Gemini Spark」ではメールやスケジュールなど複数のアプリを横断し、利用者の指示に基づいて作業を代行してくれます。
クラウド上で動くため、パソコンを閉じた状態でも24時間作業を進めることができます。
ブラウザのクロームとも連携する予定で、メールやカレンダーなども含めた個人利用が多い強みをいかし、エージェント分野での存在感を高めたい狙いもあるとみられます。
注目の記事
「森と自分、お互いが共に豊かになれるように」 森の香りをアロマに 1kgの枝から精油 わずか4ml 枝の採取、蒸留も自ら 山梨で手作りのアロマブランド

「暴力と胸や尻を触るセクハラが日常に」北海道京極町の農業法人で虐待か…避難したミャンマー人女性4人が明かす凄惨な実態 町議務める“父親”ら取材に応じず《連載1》

「もうダメかなと…」熊本地震で1階が全壊した実家 「助けてくれ」絶望のなか聞こえた父の声…地域住民がチェーンソーを手に繰り広げた“2時間の救出劇”

高速道路のサービスエリアのトイレでお尻から大量に出血し、痙攣している男性…「床一面にサラサラとした血が…」居合わせた人たちの行動に反響 高速バスの10分休憩で対応し、時間が過ぎてしまったけれど…「日本は良い国、すごい国」

【独自】粗悪モバイルバッテリーの闇 容量は10分の1… 会社は「もぬけの殻」 徹底追跡で判明

「7秒」で生死分ける戦場 ドローン攻撃を再現…“完全非公開”施設でのAI訓練の実態 日本進出へ開発者の本音









