Preferred Networks(PFN)は2026年10月6日、Microsoft Foundryで国産の生成AI基盤モデル「PLaMo」の提供を開始しました。対象はPLaMo 3.0 Prime、PLaMo 2.2 Prime、PLaMo翻訳で、PFNによると自社専用の閉域環境で利用できます。企業のAI導入担当者にとって、モデルの用途と、Azureの基盤費用を含む総額を確認する新たな選択肢になります。
長文処理と日本語の翻訳に対応
Microsoft Foundryは、企業向けにAIアプリの開発、公開・配置、管理を支援するサービスです。旧名称はAzure AI Foundryです。PLaMoは、PFNが国内で一から開発する生成AI基盤モデルです。
PFNによると、PLaMo 3.0 Primeでは、推論を行うReasoningモデルと、Non-reasoningモデルを選べます。一度に扱える情報の長さを示すコンテキスト長は256kで、長文処理や、AIに作業を進めさせるエージェント用途に対応します。ただし、今回の事実には、両モデルの性能差や業務別の評価結果はありません。導入判断では、候補の機能と自社の作業への適合性を分けて確かめる必要があります。
PLaMo翻訳は、日本語から英語、英語から日本語を中心に、日本語を入力または出力に使う翻訳に特化しています。長文処理を検討する部門と翻訳を検討する部門では、まず比較するモデルを分けるとよいでしょう。
日本で利用できるリージョン、つまりサービスを動かす地域や、日本向けの料金は、発表には書かれていません。日本語の翻訳への対応と、日本国内の基盤で利用できるかどうかは、別の確認事項です。
表示料金だけでは総額にならない
Microsoft Foundryでのモデル利用は従量課金制です。発表に記載された、計算処理を担うGPU1枚あたりの料金は次のとおりです。
- PLaMo 3.0 Prime:NVIDIA A100で1時間$3.99、NVIDIA H100で1時間$6.99。
- PLaMo 2.2 Prime:NVIDIA A100で1時間$0.99。
- PLaMo翻訳:NVIDIA A10で1時間$3.99、NVIDIA A100で1時間$9.99。
各モデルの料金には、別途Azureインフラストラクチャコストが加算されます。見積もりでは、上記のモデル料金と、Azureの基盤費用を分けて整理してください。モデルの名前だけでなく、利用するGPUによっても料金が異なります。
また、PFNは自社専用の閉域環境で利用できると説明しています。一方、具体的なネットワーク構成や設定手順は、今回の事実にはありません。「閉域で使える」という説明だけで、自社が求める接続条件を満たすと判断しないことが大切です。
影響する会社・しない会社
- 影響する: Microsoft Foundryを使っている、または導入を検討している会社。PLaMoの3モデルが検討対象に加わります。
- 影響する: 長文処理、エージェント用途、日本語を含む翻訳を検討している会社。用途に合うモデルとGPU構成を選び、費用を確認する必要があります。
- 影響しない: Microsoft Foundryの利用も導入も予定していない会社。今回の発表を受けて実施すべき変更は示されていません。
- 影響しない: 今回の提供を利用しない既存システム。既存の契約やモデルを変更する義務は、発表には書かれていません。
情シスが今日やること
- 今日、Microsoft Foundryの利用担当者に、現在の利用状況とPLaMoを試す予定の有無を確認します。管理画面での確認が必要な場合は、対象モデルを利用できるかと利用地域を確認項目にします。具体的な画面名や操作経路は、発表には書かれていません。
- 試用を始める前に、利用部門へ用途を確認します。長文処理やエージェント用途ならPLaMo 3.0 Prime、日本語を含む翻訳ならPLaMo翻訳を候補として整理します。ReasoningとNon-reasoningのどちらを評価するかも記録してください。
- 予算承認前に、クラウド費用の担当者へ、モデル名、GPUの種類、予定する利用時間を渡します。モデル料金だけの試算と、Azure基盤費用を含む見積もりを区別し、追加費用を確認します。
- 社内データを使う前に、ネットワーク担当者と情報セキュリティ担当者へ、閉域環境の構成と利用地域の確認を依頼します。自社の条件を満たすか未確認の間は、業務データを使った評価に進めない運用を検討してください。