
edge-aiエッジAI
エッジAIとは、センサー、スマートフォン、車両、産業機器など、データが生まれる場所の近くでAI推論や一部学習を実行する技術です。低遅延や通信量削減、データ最小化に役立ちますが、端末差や電力、更新、安全性の管理が欠かせません。
Technologyを詳しく見る→技術カテゴリー
人工知能とは、認識・学習・推論・生成・予測や意思決定など、人間の知的活動の一部をコンピュータで実現する技術カテゴリーである。対話AI、マルチモーダルAI、連合学習、エッジAI、世界モデルなど、データからパターンを学び結果を導くTechnologyを含む。一方、AIを利用していても中核が通信・計測・機構にあるものや、単純なルール処理のみのものは含めない。
すべての未来道具から探すTechnology
11件のTechnology

edge-aiエッジAIとは、センサー、スマートフォン、車両、産業機器など、データが生まれる場所の近くでAI推論や一部学習を実行する技術です。低遅延や通信量削減、データ最小化に役立ちますが、端末差や電力、更新、安全性の管理が欠かせません。
Technologyを詳しく見る→
computer-visionコンピュータビジョンとは、カメラ画像や動画から物体、人物、領域、姿勢、動き、場面の意味を推定し、機械が視覚情報を利用できる形に変換する技術です。画像処理だけでなく、物体検出、認識、セグメンテーション、姿勢推定、追跡、検査、ロボットの視覚認識を含みますが、LiDAR点群取得、SLAMの自己位置推定、マルチモーダルAI全般、世界モデルの長期予測とは分けて扱います。フィジカルAIの文脈では、AIが現実世界を視覚的に認識するための知覚入力を担います。
Technologyを詳しく見る→
seamless-streamingシームレスストリーミングとは、発話の終了を待たずに入力音声を逐次処理し、多言語の音声認識、翻訳、音声生成を低遅延で出力するストリーミング音声翻訳技術です。会話の障壁を下げられますが、部分入力による誤訳や話者交替、対応言語差が残ります。
Technologyを詳しく見る→
social-graph-analysisソーシャルネットワーク分析とは、人や組織、アカウントをノード、関係や相互作用をエッジとして表し、経路、中心性、コミュニティ、拡散構造などを分析する技術です。関係図の可視化や不正検知に使われますが、現実の信頼や意思を完全に表すものではありません。
Technologyを詳しく見る→
multimodal-aiマルチモーダルAIとは、文章、画像、音声、動画など異なる形式の情報を対応付けながら共同で理解・生成するAI技術です。文章だけの生成AIや単純なセンサーデータ結合とは別で、入力間の関係を保った解釈と出力が中心になります。
Technologyを詳しく見る→
world-model世界モデルとは、観測と行動から環境の状態変化や将来を内部表現として学び、次の状態や映像、センサー出力などを予測・生成するモデル群です。デジタルツインのように実在対象と継続同期する概念とは異なり、学習した遷移を使ってシミュレーションや訓練に活用する点が中心です。
Technologyを詳しく見る→
conversational-ai対話AIとは、人の発話や文章を複数ターンで受け取り、対話履歴や外部情報を踏まえて応答を返す技術です。音声認識や音声合成を含むことはありますが、中核は発話理解、対話状態管理、応答生成にあります。
Technologyを詳しく見る→
affective感情認識とは、表情、音声、姿勢、生理信号などから人の情動状態や反応傾向を確率的に推定する技術です。本人の内面を直接読み取るものではなく、文脈差や文化差、個人差を含む不確実な観測として扱う必要があります。
Technologyを詳しく見る→
generative-agents生成AIエージェントとは、言語モデルを基盤に記憶、計画、内省、対話、外部ツール利用を組み合わせ、継続的に行動するソフトウェア技術です。単発の文章生成とは異なり、状況を引き継ぎながら判断や実行を続ける構成が中心ですが、権限管理や評価可能性が重要です。
Technologyを詳しく見る→
federated-learning連合学習は、端末や組織に分散した学習データを中央へ集約せず、各参加者がローカルで計算したモデル更新を集約して共有モデルを学習する方式です。スマートフォンの入力支援や複数医療機関の共同研究などで実運用されています。ただし、データを移動しないことだけでプライバシーが保証されるわけではなく、更新からの情報復元、参加者識別、データ汚染、非IIDデータ、通信量、公平性への対策が必要です。
Technologyを詳しく見る→
tts音声合成とは、文章や音素列などを入力に、人が聞き取れる音声波形を生成する技術です。読み上げや対話インターフェースで広く使われますが、話者の同意やなりすまし対策など運用面の管理も欠かせません。
Technologyを詳しく見る→Future Tool applications
14件見つかりました