Found 3025 bookmarks
Newest
XやDiscordなどでGIF検索に使われてきた「Tenor」のAPI提供が終了
XやDiscordなどでGIF検索に使われてきた「Tenor」のAPI提供が終了
GIF検索サービス「Tenor」のAPI提供が2026年6月30日をもって終了しました。Tenorを傘下に置くGoogleによると「コア製品の強化にリソースを集中させる継続的な取り組みの一環」だとのことです。
·gigazine.net·
XやDiscordなどでGIF検索に使われてきた「Tenor」のAPI提供が終了
動画ダウンローダー「yt-dlp」のインストール手順まとめ、wingetコマンドでサクッとインストール可能
動画ダウンローダー「yt-dlp」のインストール手順まとめ、wingetコマンドでサクッとインストール可能
「yt-dlp」はYouTubeなどの動画配信サイトからコンテンツをダウンロードできるコマンドラインツールです。Microsoft公式パッケージ管理ツールの「WinGet」を使うとコマンド一発でインストールできるので、インストール手順を改めてまとめておきます。
·gigazine.net·
動画ダウンローダー「yt-dlp」のインストール手順まとめ、wingetコマンドでサクッとインストール可能
Google画像検索が提供開始25周年を迎えて刷新へ、「AIによる概要」で画像生成が可能に
Google画像検索が提供開始25周年を迎えて刷新へ、「AIによる概要」で画像生成が可能に
Googleが、Google画像検索の提供開始25周年に合わせて、検索前からウェブ上の画像を閲覧できる新しいホーム画面と、検索結果の「AIによる概要」で画像を生成できる機能を発表しました。画像を探すだけでなく、利用者の関心に沿った画像を眺めたり、求める画像をその場で生成したりできるサービスへと刷新されます。
·gigazine.net·
Google画像検索が提供開始25周年を迎えて刷新へ、「AIによる概要」で画像生成が可能に
宇宙空間でのX線写真撮影に成功、宇宙での医療やデバイス非破壊検査への活用が期待される
宇宙空間でのX線写真撮影に成功、宇宙での医療やデバイス非破壊検査への活用が期待される
宇宙空間でX線写真を撮影するミッション「SpaceXray」の成果が2026年7月14日に放射線関連の学術誌であるRadiologyに掲載されました。研究チームは宇宙空間で人体やデバイスのX線写真を撮影することに成功しています。
·gigazine.net·
宇宙空間でのX線写真撮影に成功、宇宙での医療やデバイス非破壊検査への活用が期待される
約1兆パラメーターで画像・音声の理解やコーディングに対応、用途別に調整できるオープンウェイトAIモデル「Inkling」登場
約1兆パラメーターで画像・音声の理解やコーディングに対応、用途別に調整できるオープンウェイトAIモデル「Inkling」登場
AI企業のThinking Machines Labが、用途に合わせた追加学習を重視する新たなAIモデル「Inkling」を発表しました。モデルの重みが公開されるオープンウェイトモデルで、文章だけでなく画像や音声も扱えるほか、思考に使う計算量の調整も可能とのことです。
·gigazine.net·
約1兆パラメーターで画像・音声の理解やコーディングに対応、用途別に調整できるオープンウェイトAIモデル「Inkling」登場
年を取ると人の顔が見分けられなくなるのは「目の動かし方が不安定になるから」かもしれない
年を取ると人の顔が見分けられなくなるのは「目の動かし方が不安定になるから」かもしれない
年を取るにつれて人の顔を見分ける能力が低下することは知られていますが、その仕組みは十分に解明されていません。香港科技大学や香港理工大学などの研究チームは顔認識実験の結果から、顔を見る際の目の動かし方が不安定になることが加齢に伴う顔認識能力の低下の一因になり得ると指摘しています。
·gigazine.net·
年を取ると人の顔が見分けられなくなるのは「目の動かし方が不安定になるから」かもしれない
Grokを悪用して児童性的虐待画像を作成した男性をSpaceXAIが提訴
Grokを悪用して児童性的虐待画像を作成した男性をSpaceXAIが提訴
イーロン・マスク氏が立ち上げたAIスタートアップのSpaceXAI(元xAI)が、AI・Grokを悪用して児童性的虐待画像(CSAM)のディープフェイクを作成したとして逮捕されたサウス・カロライナ州の男性を提訴しました。AIシステムを使ってわいせつなコンテンツを生成したユーザーをAI企業が提訴した初期事例として注目されています。
·gigazine.net·
Grokを悪用して児童性的虐待画像を作成した男性をSpaceXAIが提訴
画像生成AI「Qwen-Image-3.0」が登場したので使ってみた、イラストや日本語テキストの描画性能はいかに
画像生成AI「Qwen-Image-3.0」が登場したので使ってみた、イラストや日本語テキストの描画性能はいかに
中国の大手テクノロジー企業であるAlibabaのAI研究チームが画像生成AI「Qwen-Image-3.0」をリリースしました。Qwen-Image-3.0は「小さな文字を含む画像」を生成することを得意としているほか、物体の質感を細かく表現することもできるとのこと。Qwen Studioのアカウントを作成すれば無料で使用可能だったので使ってみました。
·gigazine.net·
画像生成AI「Qwen-Image-3.0」が登場したので使ってみた、イラストや日本語テキストの描画性能はいかに
NVIDIAがAI動画を最大92%の精度で識別可能なツール「Synthetic Video Detector」を発表
NVIDIAがAI動画を最大92%の精度で識別可能なツール「Synthetic Video Detector」を発表
NVIDIAは、AIで生成された可能性がある動画をフレーム単位で解析する「Synthetic Video Detector」を発表しました。報道機関や放送局などでの利用を想定したAIマイクロサービスで、非圧縮動画では最大92%の精度を記録し、1080p動画を最短22ミリ秒で処理できるとされています。
·gigazine.net·
NVIDIAがAI動画を最大92%の精度で識別可能なツール「Synthetic Video Detector」を発表
モナリザなどをAIに描かせて完成物やコスパを比較、特にGrokだけが飛び抜けて奇妙な結果に
モナリザなどをAIに描かせて完成物やコスパを比較、特にGrokだけが飛び抜けて奇妙な結果に
最先端のAIモデルを一カ所でまとめて試せるプラットフォームのTryAIが、Anthropicが2026年6月10日にリリースしたClaude Fable 5、OpenAIが2026年6月29日に発表したGPT-5.6 Sol、SpaceXAIが2026年7月9日にリリースしたGrok 4.5、Googleが2026年7月22日に発表したばかりのGemini 3.6 Flashという4つのAIに、さまざまな画像を描画させることで各AIのコストパフォーマンスや画像生成性能を比較しています。
·gigazine.net·
モナリザなどをAIに描かせて完成物やコスパを比較、特にGrokだけが飛び抜けて奇妙な結果に
画像も動画も音声も生成できるAI「FLUX 3」が発表される
画像も動画も音声も生成できるAI「FLUX 3」が発表される
AI開発企業のBlack Forest Labsが独自開発のAIモデル「FLUX 3」を発表しました。FLUX 3は「画像」「動画」「音声」の生成に対応したマルチモーダルモデルで、記事作成時点では動画生成機能が早期アクセス版としてリリースされています。
·gigazine.net·
画像も動画も音声も生成できるAI「FLUX 3」が発表される
画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場
画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場
生成AI企業のRunwayは2026年7月23日、画像・動画・音声の生成に使うAIモデルを自動で選択する「Runway Media Router」を発表しました。開発者向けプラットフォーム「Runway Dev」に追加された新機能で、品質や処理速度、料金の優先順位に合わせて自動で利用モデルを切り替えます。
·gigazine.net·
画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場
自分の顔をAIにレンタルする行為が中国で流行
自分の顔をAIにレンタルする行為が中国で流行
顔を無断で使用した動画が権利関係の問題で削除される事例が中国で相次いでいます。こうした状況を逆手に取り、最初から顔の使用権を販売しようとするビジネスモデルが成立していることが伝えられました。
·gigazine.net·
自分の顔をAIにレンタルする行為が中国で流行
Google Earthに追加された「架空の衛星画像を生成するAI機能」がわずか1日で撤回、偽の災害・軍事画像を作成可能だったため
Google Earthに追加された「架空の衛星画像を生成するAI機能」がわずか1日で撤回、偽の災害・軍事画像を作成可能だったため
Googleは画像生成AIモデル「Nano Banana 2」を使ってGoogle Earth上の風景を加工できる画像生成機能を公開しましたが、偽の災害現場や軍事施設などを容易に作成できることが問題視され、提供開始からわずか1日で機能を撤回しました。Googleは、ポリシーに違反するとみられる生成画像のスクリーンショットが共有されていたとして、より強力な安全対策を導入するまで機能を停止すると説明しています。
·gigazine.net·
Google Earthに追加された「架空の衛星画像を生成するAI機能」がわずか1日で撤回、偽の災害・軍事画像を作成可能だったため
フルカラーで見える暗視ゴーグルを可能にする技術が開発される、ただし実用化には課題あり
フルカラーで見える暗視ゴーグルを可能にする技術が開発される、ただし実用化には課題あり
北京理工大学の研究チームが、赤外線の波長と強度を可視光の色と明るさに変換し、人間が赤外線を「フルカラー」で見られるようにする光電変換デバイスを開発しました。試作した半透明のメガネ型装置は重さ23gで、従来の単色表示よりも微細な赤外線の違いを識別しやすく、暗所での視認や拡張現実、視覚補助技術への応用が期待されています。
·gigazine.net·
フルカラーで見える暗視ゴーグルを可能にする技術が開発される、ただし実用化には課題あり
動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定
動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定
AI開発企業のBlack Forest Labsが動画生成AI「FLUX 3 Video」を現地時間の2026年8月4日に一般公開しました。FLUX 3 Videoは最大20秒・1080p(フルHD)の音声付き動画を生成可能です。
·gigazine.net·
動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定
Mistral AIが小型モデレーションAI「Shieldstral」を公開、文章や画像を自然言語のルールで判定可能
Mistral AIが小型モデレーションAI「Shieldstral」を公開、文章や画像を自然言語のルールで判定可能
フランスのAI企業Mistral AIが2026年8月4日、文章や画像が指定した安全基準に当てはまるかを判定するAIモデル「Shieldstral 1.0 3B」を公開しました。パラメーター数は30億で、サービスごとの安全基準を自然な文章で指定できる点が特徴です。
·gigazine.net·
Mistral AIが小型モデレーションAI「Shieldstral」を公開、文章や画像を自然言語のルールで判定可能
アニメーションっぽく画像が動く「レグレッシブJPEG」とは?
アニメーションっぽく画像が動く「レグレッシブJPEG」とは?
「レグレッシブJPEG」とはJPEGのプログレッシブ表示機能とスキャン範囲の制御を利用して単一の画像ファイル内に複数の画像を埋め込み、アニメーションやビデオのように見せる技術です。レグレッシブJPEGとはどんなものかについては以下のブログサイトで解説しています。
·gigazine.net·
アニメーションっぽく画像が動く「レグレッシブJPEG」とは?
動画生成AI「MiniMax H3」の開発チームが「画像生成・編集モデル」「動画アップスケールモデル」「低ステップ版MiniMax H3」を準備中であることを明言
動画生成AI「MiniMax H3」の開発チームが「画像生成・編集モデル」「動画アップスケールモデル」「低ステップ版MiniMax H3」を準備中であることを明言
オープンモデルとして公開されている動画生成AI「MiniMax H3」の開発チームがオンライン掲示板のRedditでAMA(Ask Me Anything:何でも聞いて企画)を実施し、今後も各種AIモデルを公開予定であることを明言しました。
·gigazine.net·
動画生成AI「MiniMax H3」の開発チームが「画像生成・編集モデル」「動画アップスケールモデル」「低ステップ版MiniMax H3」を準備中であることを明言
Grokの画像生成AIが「Imagine Image 2.0」にアップデートされたので使ってみた、実写風もイラスト風も対応し文字も描写可能
Grokの画像生成AIが「Imagine Image 2.0」にアップデートされたので使ってみた、実写風もイラスト風も対応し文字も描写可能
SpaceXAIが画像生成AI「Imagine Image 2.0」を2026年8月7日にリリースしました。Grokの無料ユーザーでも実行可能だったので、実際に複数の画像を生成して性能を確かめてみました。
·gigazine.net·
Grokの画像生成AIが「Imagine Image 2.0」にアップデートされたので使ってみた、実写風もイラスト風も対応し文字も描写可能
Googleが手話をテキストに変換するAIモデルをPixel 11に搭載
Googleが手話をテキストに変換するAIモデルをPixel 11に搭載
Google DeepMindの手話チームが、手話の映像を文字に変換する「多言語手話・テキスト変換(sign-language-to-text:SL2T)翻訳モデル」を発表しました。2026年8月20日発売のPixel 11で、手話で文字を入力できるようになる予定です。
·gigazine.net·
Googleが手話をテキストに変換するAIモデルをPixel 11に搭載
スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる
スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる
アメリカに拠点を置くAI企業のLiquid AIが視覚言語モデル「LFM2.5-VL-3B」を発表しました。LFM2.5-VL-3Bはスマートフォンでも動作することが確認されている軽量VLMで、文書のOCRやUIの認識などが可能。オープンモデルとして公開されており、無償でダウンロード可能です。
·gigazine.net·
スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる
監視カメラメーカーのFlockが不正利用対策を表明、データ保存期間を30日間から7日間に短縮し目的別フィルタリング機能も追加
監視カメラメーカーのFlockが不正利用対策を表明、データ保存期間を30日間から7日間に短縮し目的別フィルタリング機能も追加
アメリカ全土にナンバープレート追跡用の監視カメラネットワークを構築しているFlock Safety(Flock)が、「監視カメラ映像が警察官によるストーキングに悪用されていた」などのスキャンダルを受けて、不正利用を防ぐための対策を表明しました。
·gigazine.net·
監視カメラメーカーのFlockが不正利用対策を表明、データ保存期間を30日間から7日間に短縮し目的別フィルタリング機能も追加
画像生成AIを開発するMidjourneyが係争中のハリウッドの映画スタジオに対してAIの利用状況の詳細を明らかにするよう要求
画像生成AIを開発するMidjourneyが係争中のハリウッドの映画スタジオに対してAIの利用状況の詳細を明らかにするよう要求
画像生成AIを開発するMidjourneyがディズニー、ユニバーサル、ワーナーブラザース・ディスカバリー(WBD)の大手映画スタジオ3社との著作権訴訟において、スタジオ側のAI利用実態を開示するよう求めています。両者の対立は開示手続きの範囲を巡るものに移っており、担当判事は消費者向けの映像や画像に関する情報のみ開示対象とする判断を示していましたが、Midjourneyはこの制限の撤回を求める申立てを行いました。
·gigazine.net·
画像生成AIを開発するMidjourneyが係争中のハリウッドの映画スタジオに対してAIの利用状況の詳細を明らかにするよう要求
MetaがGIFアニメも作れる画像生成AI「Muse Image」をリリース&音声付き動画を生成できる「Muse Video」も発表される
MetaがGIFアニメも作れる画像生成AI「Muse Image」をリリース&音声付き動画を生成できる「Muse Video」も発表される
現地時間の2026年7月7日、Metaが画像生成AI「Muse Image」と動画生成AI「Muse Video」を発表しました。Muse Imageはすでにサービスが展開されていて、Muse Videoは近日中にサービス開始予定です。
·gigazine.net·
MetaがGIFアニメも作れる画像生成AI「Muse Image」をリリース&音声付き動画を生成できる「Muse Video」も発表される
AIへの画像入力は解像度を下げると逆にコストが増えることがあるという実験結果
AIへの画像入力は解像度を下げると逆にコストが増えることがあるという実験結果
AIモデルの中には画像認識に対応したものが多くあります。AIに画像を認識させるワークフローのコスト削減策として「入力画像の解像度を低くする」というアイデアが広がっているのですが、AIのAPI提供サービスを展開するOpenRouterが「解像度を低くすると逆にコストが増大する」という実験結果を報告しています。
·gigazine.net·
AIへの画像入力は解像度を下げると逆にコストが増えることがあるという実験結果
AI時代において「CAPTCHA」に意味はあるのか?
AI時代において「CAPTCHA」に意味はあるのか?
ウェブサイトのログインやフォーム入力時には画像の中から特定の物体を選ぶもの、「私はロボットではありません」というチェックボックスをクリックするもの、パズルのピースを正しい位置に合わせるものなどさまざまな認証テストが使われています。こうした認証テストは「CAPTCHA」と呼ばれ人間とボットを見分けるために使われてきましたが、AIの進歩によって有効性が疑問視されていると科学系メディアのLive Scienceが解説しています。
·gigazine.net·
AI時代において「CAPTCHA」に意味はあるのか?
動画生成AI「LTX-2.3」の開発チームがAI企業「LTX」として独立、仮想世界シミュレーションを可能とする世界モデルを開発中でオープンモデルの姿勢は維持
動画生成AI「LTX-2.3」の開発チームがAI企業「LTX」として独立、仮想世界シミュレーションを可能とする世界モデルを開発中でオープンモデルの姿勢は維持
動画生成AI「LTX-2」や「LTX-2.3」の開発チームがAI企業「LTX」として独立することを発表しました。LTXは仮想世界を構築して物理現象などのシミュレーションを可能とする世界モデルの研究に取り組んでおり、今後も自社製AIモデルをオープンモデルとして公開し続ける姿勢を示しています。
·gigazine.net·
動画生成AI「LTX-2.3」の開発チームがAI企業「LTX」として独立、仮想世界シミュレーションを可能とする世界モデルを開発中でオープンモデルの姿勢は維持