
OpenAIは、GlassAIニューラル画像信号プロセッサを開発したカリフォルニアのスタートアップ、Glass Imagingを買収したと報じられている。この取引による同社の評価額は3億ドル以上とされる。双方はこの買収を認めておらず、OpenAIは、極めて小型のカメラからよりリアルな詳細を引き出すことを唯一の事業としているこのチームを、どのような目的で活用するつもりなのかについては明らかにしていない。スマートフォン、ドローン、あるいはポケットサイズのカメラで撮影する人にとって、AI研究所がセンサーとファイルの間のプロセスを掌握することになった場合、何が起こるのかが懸念される。
この報道はウォール・ストリート・ジャーナルによるもので、同紙は事情に詳しい関係者の話として、買収がここ数ヶ月の間にひっそりと完了したと伝えている。TechCrunchによると、OpenAIはコメント要請に対して即座に回答しなかったという。Glass Imaging自身のブログには売却に関する言及はない。本記事執筆時点で、報道から1週間以上が経過しているが、いずれの企業も声明を発表していない。
この件に関する最も近い形の言及は、同社の初期支援者たちから出ている。最初の投資家であるGround Up Venturesのデビッド・スターク氏はLinkedInに、同紙の報道内容の詳細は確認できないものの、創業者が「OpenAIの中で成し遂げるであろうこと」を楽しみにしていると書き込んだ。また、GVやInsight Partnersのパートナーたちも同様の別れのメッセージを投稿した。アッタール氏はこれらに感謝の意を込めて再シェアした。したがって、売却そのものは争われていないが、価格や構造、チームや顧客の行方は未確認のままであり、本記事ではその点を踏まえて扱う。

Glass Imagingとは?
グラス・イメージングは2019年、ジヴ・アッタール(CEO)とトム・ビショップ(CTO)によって設立された。TechCrunchによると、この2人は元Appleのエンジニアであり、iPhoneの「ポートレートモード」を開発したチームを率いていた。アッタールは以前にもイメージング関連企業の買収を経験しており、Appleが2015年に買収したマルチアパーチャカメラ企業LinX Imagingの共同設立者でもある。
同社は、デバイスメーカーではなくサプライヤーとしての立場を明確にした。2025年の最新の資金調達発表において、グラス・イメージングは自社の事業を、スマートフォン、ドローン、ウェアラブル機器向けの「ライセンス可能な知的財産(IP)」の開発であると説明した。この表現は、この記事の後半で重要になる。
処理チェーンの代わりに単一の学習済みネットワーク
従来の画像信号プロセッサ(ISP)は、デモザイク、ノイズ低減、シャープネス処理、レンズ補正、マルチフレーム融合といった、個別に調整された一連の段階を経て、センサーデータを画像に変換する。GlassAIは、その一連の処理を、特定のカメラモジュール用に学習させた1つのニューラルネットワークに置き換えている。同社によれば、このネットワークは、その特定のレンズとセンサーが画像をどのように劣化させるかを学習し、RAWデータのバーストからレンズの収差やセンサーの欠陥を補正する。処理はデバイス自身のニューラルプロセッサ上で実行される。
Glass Imagingは、これにより「カメラ性能を10倍に向上させられる」と主張しており、その結果は「幻覚や光学的な歪みなく、現実を忠実に再現する」としている。いずれもメーカー側の主張だ。前者に具体的な数値は示されておらず、後者についても独立した測定結果は確認されていない。このアプローチがもたらす実際的な影響は、より明確に把握できる。各ネットワークはモジュールごとに最適化されているため、新しいセンサーとレンズの組み合わせが登場するたびに、ツールを所有する側による新たな学習作業が必要となる。
静止画だけにとどまらない
ここで、この話は写真分野を超えて重要性を帯びてくる。昨年のクアルコムのSnapdragon Summitにおいて、Glass ImagingはGlassAI VideoをSnapdragon 8 Elite Gen 5のリファレンスデバイス上で実演し、Hexagon NPU上で20倍ズーム以上の4K動画をリアルタイムで処理した。1月には、同社はRAW動画用ニューラルISPパイプラインが量産段階に入ったと、同じプラットフォーム上で発表し、30fpsの4Kと表示されたデモクリップを公開した。
用語には注意が必要だ。ここでの「RAW動画」とは入力データを指すものであり、記録形式を指すものではない。GlassAIはQuad-CFA RAWセンサーデータを取り込み、標準的なISPや通常のリモザイク処理をバイパスし、ノイズリダクション、シャープネス処理、画像仕上げがすでに適用された完成済みのRGB動画ストリームを、フレームごとに、かつクラウド接続なしで出力する。CTOのトム・ビショップ氏は、出力には「生成によるアーティファクトがない」と述べた。リリースでは、レイテンシーや消費電力について「許容範囲内」と記述されている以外、具体的な数値は示されていない。

最初の市販製品は春に登場した。HONORがGlassAIによるズーム画像処理を搭載した600シリーズを発売したのだ。このスマートフォンは2億画素のメインカメラを中核としており、ベースモデルには望遠モジュールが全く搭載されていないため、そのズーム範囲はメインセンサーのトリミングと、そのトリミング部分からネットワークがどれだけ詳細を復元できるかに依存する。
なぜAI研究所がカメラパイプラインを欲しがるのか?
OpenAIはこの点について回答していないため、以下は当方の見解である。同社は2025年、ジョニー・アイブ氏のハードウェアスタートアップ「io Products」を約65億ドルの取引で買収し、それ以来両社はコンシューマー向けデバイスの開発に取り組んでいる。今年初めの「iyO」商標紛争における裁判書類には、最初のデバイスが2027年2月末までは顧客に出荷されないことが明記されていた。7月、ブルームバーグは、このデバイスが家庭向けのAIコンパニオンとして設計された、画面のないポータブルスピーカーであり、周囲を読み取るためのカメラとセンサーを搭載し、今年中に発表され、2027年に発売される予定であると報じた。OpenAI自身はこのデバイスについて説明していない。

その報道が事実であれば、カメラは小型であり、ビジョンモデルは光学系と処理によって提供される情報しか解釈できない。7年間にわたり、性能の劣るレンズや微細なピクセルから細部を復元してきたチームは、この課題に明らかに適している。ウォール・ストリート・ジャーナル紙も、ハードウェア開発の取り組みについて同様の見解を示している。
アップルとの関連には、法的な背景もある。7月、アップルはカリフォルニア州北部地区連邦地方裁判所で、OpenAI、io Products、最高ハードウェア責任者のタン・タン氏、および元アップルエンジニアを提訴し、OpenAIのハードウェア開発に関連して営業秘密の窃盗および契約違反があったと主張した。訴状によると、現在400人以上の元アップル社員がOpenAIで働いているという。OpenAIは「他社の営業秘密には一切関心がない」と反論し、ブルームバーグによると、8月に裁判所に対し、本件は根拠がないとして却下するよう求めた。この訴訟の内容には、Glass Imagingに関する言及は一切ない。同社の創業者は2019年に会社を立ち上げる前にアップルを退社しているからだ。しかし、これは、ハードウェアチームの構築方法を巡ってすでにアップルと法廷闘争中の企業に、別の元アップルカメラエンジニアグループが加わることになることを意味する。
これを生成型動画への動きと解釈するには慎重であるべきだ。OpenAIはハリウッドとの著作権争いやディズニーからの投資が破談になった後、アプリとAPIを含め3月にSoraを停止した。GlassAIはチェーンの反対側に位置する。実際にセンサーに到達した光子を処理し、その開発元は「何も作り出さない」という約束を売りにしている。
パイプラインこそがカメラになりつつある
当サイトのラボテストを読んだ読者なら、これがどこへつながるかはすでに理解しているだろう。iPhone 17 Proを標準手順でテストした際、フルマニュアルモード、ProRes RAW、Apple Log 2の設定下でも、端末がシーンに応じた処理を適用し続けたため、ダイナミックレンジとラティチュードのテストを中止せざるを得なかった。当時の我々の結論は、iPhoneは「カメラというよりは、センサーから始まる画像生成パイプラインである」というものだった。対照的に、DJI Osmo Pocket 4Pはマニュアルモードでも確定的な挙動を示し、1インチセンサーからSNR=2で16ストップを実現した。これは我々が測定した中で最高の数値だ。
モジュールごとに学習されたニューラルISPは、これら2つの道のうち最初の道をさらに突き進んでいる。単一のネットワークがデモザイク、ノイズ除去、光学補正をまとめて処理する場合、個別のステージを無効にする余地はなく、解像度やノイズの数値はハードウェアと同様に学習内容も反映することになる。結果は正確である可能性は高いが、外部から検証するのは困難であり、これはグレーディングの段階で小型カメラの映像をシネマカメラの映像と並べて編集したい人にとって重要な点だ。
出所の追跡可能性が、2つ目の未解決点だ。昨年ソニーが動画にも拡張したC2PAコンテンツクレデンシャルは、どのデバイスがファイルを書き込んだか、その後どのような編集が行われたかを記録する。現時点で確認できる限り、ファイルが存在する以前にどの程度の再構成が行われたかについては記述されていない。グラス・イメージングの立場は、同社のネットワークが情報を生成するのではなく、キャプチャされた情報を復元するものであり、学習済みパイプラインが普及するにつれ、この区別は大きな重みを持つことになるだろう。
さらに、ライセンス事業の問題もある。HONORは顧客であり、他のメーカーも明示的なターゲットとされていた。OpenAIがGlassAIのライセンスをスマートフォンやドローンメーカーに提供し続けるのか、それとも自社ハードウェア用にチームを温存するのかは不明であり、いずれの当事者もコメントしていない。この技術を軸に将来のカメラモジュールを計画していた企業は、まずその答えを求めているだろう。
詳細については、Glass Imagingのウェブサイトをご覧ください。




































