会議の録音から自動で議事録を作成します。長文ドキュメントの要約にも使えます。
Geminiは、Googleが提供する対話型AIアシスタントで、質問への回答、文章作成、要約、アイデア出しをチャット形式で支援するAIチャットボットです。テキストだけでなく画像やファイルをもとに内容を読み取り、資料の要点整理、メール文面の下書き、表現の言い換えなどに活用できます。Google検索の情報を参照した回答や、Gmail、Googleドキュメント、GoogleドライブなどGoogleサービスとの連携にも対応しています。普段からGoogle環境で仕事や学習を進める個人、チームにとって、調査から作成までを同じ流れで進めやすい点が強みです。
Mistral AIは、フランス発の大規模言語モデルをチャット、検索、文書分析、APIから利用できるAIアシスタント基盤です。Le Chatでは対話による調査や文章作成に加え、Web検索、ファイルの要約・抽出、Canvasでの長文編集、Python実行による表やグラフ作成に対応します。開発者向けにはMistral AI StudioとAPIでモデル検証、アプリ組み込み、エージェント作成ができ、オープンモデルは主要クラウドやローカル環境での実行も選べます。社内データを管理しながら生成AIを導入したい企業、欧州系モデルや自社環境での運用を重視する開発チームに向いています。
Microsoft Copilotは、Microsoftが提供するAIチャットボットで、質問への回答、文章作成、情報整理を支援するAIアシスタントです。Web検索を踏まえた回答生成に加え、要約、翻訳、メール文面や企画案の作成に対応します。WindowsやEdge、Microsoft 365のWord、Excel、PowerPointなどと連携し、作業中の文書作成やデータ整理を補助します。Microsoft製品を日常的に使うビジネスユーザーにとって、既存の作業環境に組み込みやすい点が強みです。
Ollamaは、ローカルPCや自社サーバー上で大規模言語モデルを実行し、チャットや文章生成を行えるオープンソース系のAI実行環境です。ターミナルから`ollama run`でLlama、Mistral、Code Llama、gpt-ossなどのモデルを取得・起動でき、モデルファイルの管理もコマンドで完結します。REST APIやOpenAI互換APIを通じてアプリから呼び出せるため、社内チャット、RAG、開発支援ツールへの組み込みにも使えます。プロンプトや回答を外部サービスへ送らずにローカル処理したい開発者、研究者、企業チームに向いています。
ElevenLabsは、テキストから自然な音声を生成し、音声の文字起こしや吹き替えまで扱えるAI音声プラットフォームです。感情や間の指定を反映したText to Speech、既存音声の特徴を再現するボイスクローン、動画・音声の多言語吹き替えに対応します。Speech to Textでは録音や動画の内容をテキスト化でき、APIから生成・文字起こし・音声エージェント機能を組み込めます。YouTube動画、ポッドキャスト、広告、教材、アプリ開発で、声の品質と制作スピードを両立したいクリエイターや企業に向いています。
Rimo Voiceは、日本語の会議・インタビュー・セミナー音声をAIで文字起こしし、議事録作成まで支援するサービスです。音声・動画ファイルのアップロードや会議録音から自然な日本語テキストを生成し、発言箇所と音声をタイムスタンプで対応させて確認できます。文字起こし結果をもとにAI要約を作成でき、キーワード検索や共有により、会議後の振り返りと情報整理を進めやすくします。日本語精度とチーム利用を重視する企業、取材やセミナー記録を効率化したい担当者に向いています。
Sakana AIの日本特化LLM「Namazu」を搭載し、Web検索を組み合わせて最新情報を踏まえた日本語回答を無料で得られるAIチャットサービスです。
Muse Spark 1.1は、1Mトークンの長文脈、マルチモーダル理解、ツール利用、コーディング支援に強いMetaのエージェント向けAIモデルです。
RevComm MiiTelは、電話・Web会議・対面商談の会話をAIが録音・文字起こし・解析するクラウド音声解析サービス群。MiiTel Phone/Meetings/RecPod/Call Center/Incoming Webhookの5製品で構成され、インサイドセールスやコールセンターの通話品質標準化・教育に向く。
PKSHA Technologyは、自然言語処理を活用したAIチャットボットやFAQシステムで、顧客や社内からの問い合わせ対応を自動化するAI SaaSです。Webサイトにチャット型対話エンジンを導入し、ユーザーの質問意図を解析してFAQやナレッジから回答候補を提示できます。PKSHA FAQやPKSHA ChatAgentと連携し、FAQの作成・公開・評価、問い合わせ管理、対話ログをもとにしたナレッジ改善を支援します。コンタクトセンター、カスタマーサポート、社内ヘルプデスクなど、問い合わせ量を抑えつつ応答品質を高めたい企業に向いています。
Adobe Podcastは、Web完結のAIブラウザ音声・動画編集ツールです。Enhance Speechで背景ノイズやエコーを除去し、Studio(ベータ)でリモート収録・話者別トラック管理・文字起こしベースの編集ができます。無料でも利用でき、Adobe Firefly Proプラン加入でバルク処理や処理時間拡張などの上位機能が使えます。ポッドキャスト配信者やウェビナー編集者向け。
LMSYS Chatbot Arenaは、同じプロンプトに対する複数AIモデルの回答を匿名で比較し、人間の投票から品質順位を示す評価プラットフォームです。利用者は2つの回答を見比べて好みを投票でき、投票後にモデル名を確認しながら、実際の対話でどのモデルが強いかを体感できます。リーダーボードではテキスト系モデルを中心にスコア、順位、提供元を確認でき、モデル選定や性能比較の参考材料として使えます。新しいAIチャットボットの実力を広告文ではなくユーザー評価ベースで見極めたい開発者、研究者、導入担当者に向いています。
Kimi (Moonshot AI) は、中国のMoonshot AIが提供する、長文理解と対話型推論に強いAIチャットボットです。内蔵Web検索で最新情報を参照しながら回答を作成でき、Deep Thinking機能により複雑な質問の整理、比較、要約、手順化を支援します。さらに超長コンテキストの会話に対応し、PDFや文書の読み込み、画像を含むマルチモーダルな推論、調査や資料作成、論点分析の下準備にも使えます。大量の文献、仕様書、記事を一度に扱いたいリサーチ担当者、企画職、開発者に向く点が強みです。
ERNIE Bot(文心一言)は、Baiduが開発する中国語対応に強いAIチャットボットです。自然言語での質問応答、文章作成、要約、翻訳、アイデア出しなどをチャット形式で行えます。中国語の文脈理解を重視しており、中国市場向けの調査、業務文書、マーケティング文案の作成支援にも活用できます。中国語圏の顧客対応、情報収集、コンテンツ制作を行う企業や担当者に向いたツールです。
Zhipu AI(智谱)は中国・清華大学発のAIラボが提供するGLMシリーズ基盤モデル群。最新フラッグシップGLM-5.2、エージェントモデルAutoGLM、AIパートナー型新製品AutoClawなどをAPI・製品として展開。中国語処理とエージェント機能に強みを持つ開発者・企業向け基盤です。
AnythingLLMは、PCに常駐して動くプライベートAIアシスタント。文書を取り込んだRAG会話に加え、会議の自動文字起こし・要約、リアルタイム音声入力にも対応する。アカウント登録やAPIキー不要で個人利用でき、チーム利用はクラウド版やセルフホストも選べる。
AIチャット、コード生成、IDE連携、CLI、APIを通じて、開発者が設計から実装・検証までを効率化できるAI開発支援ツールです。
GPT Transcribeは、音声ファイルやリアルタイム入力を高精度にテキスト化し、多言語・専門用語・コードスイッチングにも対応する音声認識APIです。
Resemble AIは、音声クローン作成、テキスト読み上げ、音声変換、文字起こしを扱えるAI音声生成プラットフォームです。短い音声サンプルから話者の声を再現し、台本テキストからナレーションやキャラクターボイスを生成できます。Speech-to-Speechで話し方のニュアンスを保った音声変換や、API経由での音声生成・文字起こしワークフロー構築にも対応します。ゲーム、動画制作、コールセンター、音声アプリでブランド固有の声を運用したい企業や開発者に向いています。
Poe by Quoraは、ChatGPT、Claude、Gemini系モデルなど複数のAIに1つの画面から質問し、回答を比較できるAIチャットボットです。Webブラウザやアプリから用途に応じてモデルを切り替えながら、文章作成、要約、翻訳、アイデア出し、コード相談を行え、画像生成モデルも同じサービス内で利用できます。公開されているボットを探して会話したり、自分用のボットを作成して指示文や知識を固定した対話環境を用意できます。AIごとの回答傾向を試しながら、仕事や学習に合うモデルを選びたい個人やチームに向いています。
Googleが提供するiOS向け無料オフライン音声入力アプリ。端末内のGemmaモデルがフィラー除去と文章整形を行い、音声データはクラウドに送信されない。
Mixtralは、Mistral AIが公開したMixture of Experts(MoE)型の大規模言語モデルで、チャット応答や文章生成をAPIや自前環境に組み込めるAIチャットボット基盤です。8x7Bと8x22Bの系統があり、入力内容に応じて専門家ネットワークの一部を使う構造により、密な大型モデルより少ない計算で推論します。Instruct版の重みはApache 2.0で提供され、長い文脈の対話、要約、翻訳、コード補助、RAGアプリの応答生成に利用できます。オープンウェイトを前提に、推論コストやデータ管理を調整しながら独自チャット機能を作りたい開発者・企業に向いています。
Voicemod AIは、マイク入力の声をリアルタイムで別の声質やキャラクター風の音声に変換できるAIボイスチェンジャーです。AI Voicesで人間らしい声や個性的なフィルターを適用でき、サウンドボードで効果音を配信・通話中に即時再生できます。Voicemod Virtual Microphoneを入力デバイスに選ぶことで、Discord、ゲーム、配信ソフト、ビデオ会議などに音声加工を組み込めます。声の演出を強化したいゲーム実況者、VTuber、配信者、オンライン会議で声の印象を調整したいユーザーに向いています。
Amazon Rufusは、Amazon上の商品探しを会話形式で支援するAIショッピングアシスタントです。自然言語で条件や用途を伝えると、該当商品の候補を探したり、比較検討に必要なポイントを整理したりできます。商品ページではレビュー内容の要約や、仕様・使い方に関する質問への回答にも対応します。購入前に情報収集の手間を減らし、自分の目的に合う商品を効率よく選びたいAmazon利用者に向いています。
LINE WORKS AiNoteは、ワークスモバイルジャパンが提供する組織向けAI議事録ツール。会議音声をリアルタイムで文字起こしし、話者分離・自動話者認識・AI要約を自動処理する。チーム(19,800円/月)〜エンタープライズ(162,000円/月)の階層プランで、SSO等の企業向けセキュリティを標準搭載する。
Yi Lightningは、01.AI(零一万物)が提供する高速推論モデルを使い、対話形式で文章生成や情報整理を支援するAIチャットボットです。中国語、英語、日本語での質問応答に対応し、調査メモの要約、メールや記事の下書き、翻訳のたたき台作成に活用できます。短い指示から意図を読み取り、会話を続けながら表現の調整や追加説明を依頼できます。多言語で素早く回答を得たい個人、編集者、企画担当者、開発チームに向いています。
ChatGPTの会話画面でフォームの作成・編集・デザイン・回答分析を一気通貫で行えるJotform公式アプリ。ファイルやURLからのインポートにも対応。
Mistral Vibe(旧Le Chat)は、仕事向けのWorkとコーディング向けのCodeを1つのライセンスで使えるMistral AI公式の統合AIエージェントです。2026年5月にLe Chatから改名しました。Web検索を併用した調査や文書の要約、ファイル分析に加え、メール、カレンダー、Slack、GitHub、Jiraなど100以上の外部ツール連携を備えます。CodeモードではGitHub連携でのプルリクエスト作成、VS Code拡張、CLIからの利用にも対応します。プランはFree、Pro、Team、Enterpriseの4段階で、調査、執筆、開発を1つのエージェントに集約したい個人やチームに向いています。
GPT4Allは、Nomic AIが提供するローカル実行型のAIチャットボットで、PC上に言語モデルを読み込んで対話できるツールです。デスクトップアプリから対応モデルを選んでダウンロードし、インターネット接続や外部APIに依存せずに文章作成、要約、質問応答のチャットを行えます。LocalDocs機能ではPDFやテキストなどの手元ファイルを索引化し、内容を参照した質問応答に利用でき、Python SDKからアプリへの組み込みも可能です。社内資料や個人メモをクラウドへ送らずに扱いたいユーザー、また開発者がローカルLLMを検証する用途に向いています。
IBM watsonx Assistantは、IBMが提供するエンタープライズ向けのAIチャットボット構築基盤です。コールセンターの自動応答や社内ヘルプデスク、Webサイトの顧客対応ボットなどをノーコード中心の画面で構築でき、生成AIによる回答と、業務システムと連携した定型処理の実行を組み合わせられるのが特徴です。金融・保険・通信など規制の厳しい業界での導入実績が長年蓄積されており、オンプレミス相当の厳格なデータ管理やアクセス統制、多言語対応といったエンタープライズ要件に応えられる数少ない選択肢です。日本語対応と国内大手企業での導入事例も豊富で、全社規模の顧客接点をAI化したい企業の定番基盤と言えます。
Fireworks AIはオープンLLMの高速推論と、RL/LoRAによる独自モデルのトレーニングを統合したプラットフォームです。DeepSeek-V4-Pro・GLM 5.2・Kimi K3などの最新モデルをAPIで呼び出せるほか、自社データで学習したモデルを本番環境へ即デプロイできます。MLエンジニア・開発者向け。
Fish Audioは音声クローン・多言語TTS・音声認識・ボイスエージェントを1つのAPIで提供する音声AIプラットフォーム。10秒程度のサンプルで声を再現し、感情タグ制御に対応した最新モデルS2.1 Proでリアルタイム生成が可能。動画ナレーションや音声エージェント開発に向く。
英語音声をリアルタイムで文字起こし・要約・話者識別するAI議事録ツール。Zoom・Teams連携対応、無料プランは月300分まで利用可能。
天秤AI byGMOは、GMOインターネットグループが運営する国産のAI比較チャットサービスです。1つの質問をGPT・Claude・Geminiなど複数の主要AIモデルへ同時に投げ、回答を天秤のように横に並べて見比べられるのが最大の特徴で、モデルごとの得意不得意を体感しながら使い分けを学べます。個人は無料で始められ、国内企業の運営という安心感から生成AIの入門用途でも広く使われています。法人向けには、セキュリティ管理や利用統制を強化した「天秤AI Biz」を別プランとして提供しており、個人の試用から会社導入まで同じ操作感でつなげられます。複数モデルの回答品質を日本語で比較検討したい人の定番です。
OpenRouterは500以上のAIモデルを単一のOpenAI互換APIから呼び出せるモデルルーティングプラットフォーム。テキストに加え画像・動画・音声生成にも対応し、80以上のプロバイダーを横断してモデル選択・フォールバックができる。マルチモデル前提のAI開発者向け。
Voicenotesは、会議や日々の音声メモをAIが自動で文字起こし・要約するノートアプリ。60以上の言語に対応し、Zoomなど主要な会議アプリとボット不要で連携できる。要約・アクションアイテム抽出・過去メモへのAI質問機能を備え、会議の記録と振り返りを効率化したい個人・チーム向け。
SideChef AIは、手元の食材や好みに合わせて献立を提案し、調理手順まで案内するAI搭載レシピアシスタントです。冷蔵庫にある食材を入力すると、使える材料を活かしたレシピ候補を提示し、買い足しが必要な材料の確認にも役立ちます。料理中はステップごとのガイドで手順を追えるため、下ごしらえから仕上げまで迷わず進められます。毎日の献立作成を効率化したい家庭料理ユーザーや、食品ロスを減らしながら料理したい人に向いています。
ChatGPT・Claude・Gemini・Grokなど30以上のAIモデルの回答を1画面で比較できるチャットプラットフォーム。有料プランでは最大4モデルを同時比較できる。モデル選定やAI導入前のベンチマークをしたい個人・チーム向け。
OpenAIが公開するオープンソースの音声認識モデル。68万時間の学習データで多言語・日本語の文字起こしに対応し、モデル/コードは無償公開。ローカル実行が無料で、API利用時のみ$0.006/分の従量課金。
音読さんは、入力したテキストを自然な音声で読み上げてくれる日本発の音声読み上げサービスです。ブラウザからテキストを貼り付けるだけで使え、生成した音声はMP3でダウンロードできるため、動画のナレーション作成や教材づくり、文章の聞き直しチェックまで幅広く使われています。画像内の文字を読み上げるOCR機能や、声の速度・高低の調整にも対応します。無料でも1,000文字まで(無料の会員登録をすれば5,000文字まで)読み上げでき、月20万文字まで使える月額1,078円のベーシックプランなど有料プランで上限を広げられます。ソフトのインストールなしで手軽に読み上げ音声を作りたい個人や教育関係者の定番です。
PolyAIは、コールセンターや顧客窓口の電話・チャット対応を自然な対話型AIエージェントで自動化するエンタープライズ向けプラットフォームです。音声認識、文脈理解、自然な音声合成を組み合わせ、予約、本人確認、支払い、注文状況確認などの問い合わせを会話の流れに沿って処理できます。Agent Studioで会話フローやブランドに合わせた話し方を設計し、通話内容のレビュー、要約、分析ダッシュボードで品質改善にもつなげられます。大量の入電を抱えるコンタクトセンター、ホテル、保険、小売、配送など、待ち時間削減と応対品質の両立を狙う企業に向いています。
text-generation-webuiは「TextGen」に改称、リポジトリはgithub.com/oobabooga/textgenへ移転。デスクトップアプリとして、text/vision/tool-calling/Web検索/OpenAI・Anthropic互換APIを100%オフラインで扱える。
Forefront AIは、ClaudeやGPT-5.5など複数のAIモデルを同じワークスペースで使えるマルチモデル型AIチャットボットです。用途に応じてモデルを切り替えながら、文章作成、要約、調査、アイデア出しなどの作業をチャット形式で進められます。個人利用だけでなくチーム向けのワークスペースにも対応し、会話や作業内容を共同利用しやすい構成です。複数モデルを比較しながら日常業務や企画業務に活用したい個人、企業チームに向いています。
AnthropicのClaudeモデルをAPIで利用できる開発者向けサービス。Mythos・Fable・Opus・Sonnet・Haikuの複数モデル系統から選択でき、最大100万トークンのコンテキスト・ツール呼び出し・構造化出力・エージェント構築に対応。従量課金制。
TypingMindは自分のAPIキーで複数のLLM(GPT、Claude、Gemini等)を1つのUIから使える買い切り型チャットUI。月額課金なしでAPIキー利用分のみ支払う仕組みで、複数モデルを併用したい個人開発者・エンジニアに向く。