Technology

技術とできること

ガーニッシュは、音声・ことば・画像・空間・データを扱う技術を、ひとつのチームの中に持っています。ここに並べたものは、どれも実際にプロダクトやプロジェクトで動かしてきたものです。組み合わせることで、「こういうことはできる?」の多くにお応えできます。

01

声と会話

Voice & Conversation

文字を読むより、話しかけるほうが自然な場面はたくさんあります。AIに声と人格を与え、人と同じように会話できるようにする技術です。

声が波紋のように広がり、人とAIのあいだで会話が生まれるイメージ
  • 音声で会話するAIキャラクター

    キャラクターの声・口調・性格を設計し、ブラウザからそのままリアルタイムに音声で会話できます。一度に話せる時間の上限や、短い時間だけ有効な接続方式など、一般公開しても安全に運用できる仕組みまで含めてつくります。

    Garnish PersonaSHIORA
  • リアルタイム音声通訳

    端末1台を間に置くだけで、スタッフとお客様の会話を双方向に音声で通訳します。窓口や店頭など、ことばの壁がある接客の場面に。

    一部で提供中
  • 音声合成と声の再現

    文章を自然な声で読み上げる音声合成に加え、ご本人の同意を得たうえで、その人らしい声を再現する技術(ボイスクローン)も扱います。

  • 文字起こし

    会議や配信、動画の音声をテキストにします。翻訳や字幕づくりの最初の一歩にもなります。

    G-Flux
  • 手話の読み取り

    カメラで手の動きをとらえ、AIが意味を読み取って音声で伝える試みです。

    試作
02

ことばと翻訳

Language

翻訳は「訳して終わり」ではありません。読み取り、訳し、手直しし、届けるところまでを、ひとつの流れとして設計します。

いくつもの言語の文字が重なり合い、ひとつの意味につながっていくイメージ
  • 多言語翻訳

    料理名や説明文、アレルギー表示、よくある質問などを、最大15言語へまとめて翻訳します。訳した結果は保存して使い回し、あとから人の目で手直しできる形で管理します。

    千客万歳
  • AI動画翻訳(字幕・吹き替え)

    文字起こし、翻訳、話し手の声質を保った吹き替え、口の動きの同期までを一続きで行います。字幕ファイルは50以上の言語、主要な字幕形式で書き出せます。

    G-Flux
  • 文字の読み取りとデータ化

    紙のメニューの写真やPDF、Webページから、品名や価格を読み取り、整理されたデータにします。手入力の手間をなくし、翻訳や表示にそのままつなげます。

    千客万歳
  • 辞書データと組み合わせた翻訳

    1万語を超える独自の辞書から必要なことばだけを選んでAIに渡すことで、方言や専門用語など、一般的な翻訳が苦手なことばも訳せるようにしています。

03

画像と映像

Image & Video

伝わるかどうかは、見せ方で大きく変わります。生成AIを、撮影や編集の手間を減らし、見せ方を整えるための道具として使っています。

一枚の写真が、光や色を整えられて鮮やかに変わっていくイメージ
  • 料理写真のAI補正

    明るさ、色、質感、湯気まで整え、スマホで撮った料理写真を、お店の顔になる一枚にします。料理のジャンルごとに仕上がりを調整しています。

    千客万歳
  • バーチャル試着・合成写真

    写真1枚から、衣装や背景を差し替えた写真をつくります。服、メイク、髪型、ネイルの試着や、似合う色・体型の傾向の推定にも使えます。

  • 画像の安全チェック

    投稿された画像や生成した画像に不適切なものが含まれていないか、AIで確認してから表示します。

  • 静止画からの動画づくり・映像制作

    写真やイラストをもとに動画を生成します。古い写真に動きをつける、キャラクターの待機映像や背景のループ映像をつくる、といったことから、CMの制作まで手がけています。

04

空間とAR・3D

AR & 3D

アプリを入れてもらうのは、思った以上に高いハードルです。ブラウザだけで動くARと3Dで、「かざす」「歩く」「見て回る」体験をつくります。

スマートフォンの画面の中で、現実の風景に3Dのオブジェクトが重なって見えるイメージ
  • WebAR

    アプリのインストールなしで、スマホをかざすと3Dが現れます。ロゴや看板を認識して現れるもの、その場所に近づくと現れるもの、記念撮影ができるものなど、目的に合わせて方式を選びます。

  • ブラウザで歩ける3D空間

    地形や建物、お店の中を3Dで再現し、スマホで一人称視点のまま歩いて回れます。自然現象を学べるシミュレーションもつくっています。

  • 実写の空間をそのまま3Dに

    撮影した空間を、質感を保ったまま3Dにする技術(3Dガウシアン・スプラッティング)を使い、ブラウザで自由な角度から見て回れるようにします。

  • AIによる3D素材づくりと3D展示

    画像生成で下絵をつくり、3Dモデルに起こして、Webで扱いやすい軽さに整えます。立体物を高精細な3Dで好きな角度から鑑賞できる、バーチャル展示にも対応します。

  • ブラウザゲームと演出

    分岐するストーリーや育成の仕組み、光の粒の演出、立体音響、スマホの傾きに反応する動きなど、遊びとして楽しめる体験もつくります。

05

認識と位置情報

On-device AI & Location

いつも電波が届くとは限りません。スマホの中だけで動くAIと、位置に合わせて体験が変わる仕組みで、現地で本当に使えるものをつくります。

スマートフォンのカメラが植物をとらえ、画面に名前が表示されるイメージ
  • 端末の中で動く画像認識

    撮った写真から動植物などを見分けます。通信のない場所でも動き、自信がないときは無理に答えないよう調整しています。質問に答えながら候補を絞り込む方式にも対応します。

  • 位置と連動する案内

    決めた範囲に入ると、案内や音声ガイドが始まる仕組み(ジオフェンス)をつくります。立ち入ってはいけない場所に近づいたときの注意にも使えます。

  • オフラインで使える地図

    外部の地図サービスに頼らずに表示できる地図や、歩いた道のりの表示など、目的に合わせた地図をつくります。

06

しくみづくり

Systems

目立つ技術も、毎日の業務の中で使われて初めて意味を持ちます。現場の人が迷わず使える業務システムと、それを支える運用までを担います。

タブレットやスマートフォンがつながり、情報が整理されて流れていくイメージ
  • お店向けのメニュー・接客システム

    QRコード、タブレット、大型ディスプレイでのメニュー表示、店員の呼び出し、お店が自分で更新できる管理画面まで。アプリを入れずに使えます。

    千客万歳
  • 予約と在庫の管理

    宿泊などの予約の受け付けと在庫の管理。リクエスト予約、即時予約、他サイトへの送客など、運用に合わせた形で組み立てます。

  • 組織で使う共有ツール

    ブラウザで読み書きできるExcel互換の共有表や、暗号化したまま書類をやり取りできる書類箱など。使う端末を承認制にし、同時に編集したときの行き違いを検知し、毎日自動で控えを残します。

  • 決済とログイン

    オンライン決済サービスを使った月額課金の申し込みや支払い管理、パスワードのいらないログイン(パスキー)に対応します。

  • Webアプリ・サイトの制作と運用

    ホーム画面に追加でき、電波がなくても起動するWebアプリ(PWA)、多言語サイトの制作、サーバーの保守やセキュリティ対策まで引き受けます。

Tools

主に使っている技術

目的に合わせて、実績のある技術やAIサービスを選んで組み合わせています。

three.js / WebGL WebXR / model-viewer 8th Wall A-Frame / AR.js 3D Gaussian Splatting Blender Meshy Claude OpenAI Gemini Runway MediaPipe ONNX Runtime Web TensorFlow.js PyTorch Leaflet Web Audio PWA PHP / MySQL Stripe WebAuthn Google Cloud
How we work

進め方

いきなり大きくつくらず、まず動くものを見ながら決めていきます。

  1. ご相談

    やりたいこと、困っていることを伺います。技術の言葉でなくて大丈夫です。

  2. 試作

    小さく動くものをつくり、実際に触りながら方向を確かめます。

  3. 実装

    現場で使う人の動きに合わせて、仕上げていきます。

  4. 運用

    公開して終わりにせず、改善や保守、安全対策まで続けて支えます。

Contact

組み合わせのご相談も、
お気軽にどうぞ。

「この技術とこの技術を組み合わせたら?」という段階からご相談いただけます。

お問い合わせ