
Speechmaticsの料金を月の音声時間から出す 1時間0.129米ドルの表示に乗っている2つの割引
2026年9月21日の公式料金ページでは、料金表の先頭に出る1時間0.129米ドルは、音声と文字起こしをモデルの改善へ使う許可と引き換えの33%引きと、月500時間を超えた分への20%引きを両方入れた金額でした。学習提供に入らず、月500時間も超えない場合の基準額は、録音ファイルの文字起こしで1時間0.24米ドルから0.75米ドルです。請求は秒単位で、最高精度のモデルなら月10時間で7.50米ドル、月50時間で37.50米ドルになります。月に扱う音声時間が決まっていれば、この単価表で自社の実額を出せます。単価と条件は、公式の料金ページと公式ドキュメントに出ている範囲です。

LLMの使い分けでコストと待ち時間を下げる 分類と検査を文章生成から切り離す
同じLLMへ文章の作成も分類も検査もまとめて通すと、費用と待ち時間が件数に比例して増えます。2026年9月に早期アクセスで公開されたJevは、文章を作らず候補の確率だけを返すモデルです。提供元の公開評価では業務フロー1件あたり0.0004ドル・0.4秒で、同じ評価のGPT-5.6 Terraは0.0304ドル・10.1秒でした。ただし請求書処理では12.9ポイント下回り、費用が約200倍のGPT-5.6 Solには四つの仕事すべてで負けています。どの判断を文章生成から切り離し、どれをコードと人に残すかを、公開評価と振り分け研究から整理します。費用の数字は公開価格からの計算です。

文章を作らないAIをどこまで信じるか Jevが返す確率と型の読み方
Jevは文章を生成せず、あらかじめ定めた候補の確率だけを返すモデルです。提供元はハルシネーションしないと表現しますが、保証されるのは型を壊さないことだけで、技術問い合わせを請求へ誤分類することはあります。返ってくる確信度も、似た100件のうち何件が正しいかという集団単位の性質で、一件ごとの正しさではありません。公開評価と外部の初期試験、専用分類器との未比較まで含めて、何を任せてよいかの判断材料を整理します。

画像の「ここだけ直して」はAIに通じるか Images 2.5で月面ホテル広告を編集
OpenAIは2026年9月8日、画像生成AI「ChatGPT Images 2.5」を発表しました。指定した部分を直しながら、それ以外の見た目や以前の修正を保つ能力が改善したといいます。知能圏で架空の月面ホテルの広告を作り、価格、地球の位置、ソファの色を順に変えてみると、三つとも指示どおりに変わりました。ただ、頼んでいない壁や布の模様まで変わっていました。

業務で使う英語音声認識を選ぶ Granite Speechで精度より先に見る利用条件
Granite Speech 5.0はTTSではなく、英語音声を文字へ変えるSTT/ASRモデルです。Whisperやクラウド音声認識との違い、英語文字起こしへ機能を絞った背景を整理し、Apache 2.0版と非商用版を計9音声で試しました。公式差0.15ポイントより先に、必要な役割、モデルカードの利用条件、録音の扱いを確認する選定順を説明します。

手元PCで動くローカルAIを選ぶ llmfitの推定とM5 Max実測の差
llmfitは、端末と予定文脈からローカルLLMの適合度や速度を見積もる道具です。約278MBの4ビットモデルをM5 Maxで実際に動かすと、4096条件の推定6754 tok/sに対し実生成2回の平均は511 tok/sでした。なぜ今こうした道具が必要なのか、推定はどこまで使えるのかを、内蔵情報の照合と512、4096、8192トークンの実測から整理します。

生成AIの誤回答を直す モデル・検索・ツールの原因を切り分ける方法
生成AI製品の品質は、一件の失敗を正しい場所へ戻せるかで決まります。古い料金プランを案内した一件を追い、検索、文脈、指示、モデル、道具、評価を実行記録から切り分ける方法を説明します。
AI・モデル
生成AIと基盤モデルの能力、制約、評価方法を、製品発表や技術資料から読み解きます。
7本の記事