Megaphoneは、ライブ文字起こし、文章の整理、カーソル位置での書き換えに対応したMac向け音声入力アプリ。無料・プライベート・オープンソース。
Wisproは、Windows向けのネイティブ音声入力アプリ。ホットキーで起動し、話した内容を整えてアクティブなアプリに貼り付け。3つのモード搭載。
Dictroは、Mac向けのプライベートAI音声入力アプリ。標準のテキスト欄に話した内容を整った文章で入力し、必要に応じてクラウドのFast Modeとローカル履歴も使えます。
QuickQuillは、Macで使えるオンデバイスのプライベート音声入力・文字起こし・会議メモアプリ。無料のプッシュトゥトーク音声入力と、有料の会議記録、取り込み、要約、翻訳、書き出しに対応。
RecordMeetingは、Google Meetの会議をブラウザで録画・文字起こしできるツールです。ZoomやMicrosoft Teamsにも対応し、AIメモと共有管理を備えたプライベートワークスペースで整理できます。
VMEG AIは、170以上の言語への動画翻訳、吹き替え、字幕、ローカライズに対応したAI動画ローカライズプラットフォーム。セルフサービスと人手支援の両方に対応。
Medwriterは、診療中の会話を構造化された診療記録に変換するAI医療書記です。精神科対応、テレヘルス対応、事前承認や却下異議申立て用の文書出力も可能です。
Memo AIは、WindowsとmacOS対応のデスクトップAI文字起こしアプリ。音声・動画ファイルやリンクをテキスト化し、多言語翻訳、SRT/VTT/Markdown/Notion出力に対応。
Fathomは、通話を録音・要約し、アクション項目を生成して会議内容を検索可能にするAI会議ノートツール。Slack、Salesforce、HubSpotなどとも連携。
Cueは、会話に集中したまま録音し、文字起こし、要約、アクション項目に整理できるAI会議メモアプリ。会議、通話、面接、講義に対応し、モバイルとデスクトップで使えます。
Speaklyは、100以上のアプリで音声を洗練されたテキストに変換する無料のAI音声入力ツールです。Mac、Windows、iPhone、Android対応で、AI編集、ショートカット、エージェントモードも搭載。
Interview Solver is a desktop AI copilot for live coding and system design interviews. It helps candidates capture questions, transcribe audio, and generate structured answers during technical interviews.
NeverCapは、音声・動画を編集可能なテキストに変換するAI文字起こしツール。バッチアップロード、話者ラベル、タイムスタンプ、100以上の言語に対応し、月間分数制限なしで大量処理できます。
Typelessは、Mac、Windows、iOS、Androidで使えるAI音声入力アプリ。話すだけで、下書き・編集・翻訳まで自然に行えます。
YouTube Transcript Generatorは、公開YouTube動画から文字起こしを抽出できるWebアプリです。無料枠とAI要約、コピー・ダウンロード、上位プランのAPIに対応。
Dictationerは、音声・動画やSNSリンクから文字起こしを行うAIツール。要約、字幕、翻訳、キャプション、投稿用下書きまで作成できます。
Video Highlightは、動画をタイムスタンプ付き要約、文字起こし、ノート、検索可能なチャットに変えるAI動画要約ツール。公開動画や非公開アップロードに対応。
AdpexAIは、テキスト・画像・動画から画像、動画、音声コンテンツを生成・編集できるWebベースのAIツールです。AIチャットとコード生成にも対応。
Monologue is an AI voice dictation app that helps people write by speaking naturally, with support for transcripts, summaries, and Apple devices. It is aimed at users who want faster drafting without losing their intended meaning.
Aqua Voice is a speech-to-text product for Mac, Windows, iPhone, and AI workflows. It helps individuals, teams, and developers turn spoken input into text in real time, with an API option for transcription workflows.