30秒で分かる結論
- IBMが9月9日、時系列予測モデルPatchTST-FM-r2の公開内容を紹介しました。
- Apache 2.0とOpenMDW 1.0から選べるデュアルライセンスで、重みや推論コードを公開しています。
- 好成績は条件付きのベンチマーク評価です。自社の需要や設備データでも同じ精度になるとは限りません。
PatchTST-FM-r2は需要やセンサー値の予測に使う約3.85億パラメータのモデル。GIFT-Eval順位の対象範囲と、自社データで比較するための見方を整理
AIの順位表は、注釈を小さくすると急に王者が増える。今回も「首位」のひと言で読み終えるのはもったいない。仕事で予測に使うなら、表彰台より、自分のデータで何を外すかのほうが大事だ。※個人の感想です
PatchTST-FM-r2は、需要、電力負荷、センサー値などの時系列データを扱います。モデル規模は約3.85億パラメータで、最大8,192ステップの文脈と、将来の値の分布を表す99個の分位点を扱う設計です。文章への回答が主用途のチャットAIとは役割が異なります。
IBMによる9月8日時点のGIFT-Eval評価は、再現可能なゼロショットモデルという範囲で総合2位、さらに商用利用に寛容なライセンスのモデルに絞ると首位という説明です。ゼロショットは、対象の予測課題に合わせた追加学習なしで評価することを指します。条件を落として「すべての時系列AIで1位」と書くことはできません。
以下は編集部による評価設計の例です。本モデルの実測結果ではありません。
| 確認する点 | 比較の置き方 | 避けたい落とし穴 |
|---|---|---|
| 予測の正確さ | 同じ過去期間から同じ未来期間を予測 | 一方だけ未来の情報を使う |
| 単純な方法との差 | 前日・前週の値を使う予測も並べる | 複雑なAIなら必ず良いと思い込む |
| 不確実性 | 予測幅に実測値がどの程度収まるかを見る | 幅が出たこと自体を精度の証明にする |
| 運用の負担 | 推論時間、必要メモリー、欠損値処理を記録 | 平均誤差だけで導入を決める |
たとえば店舗の需要なら、通常日と特売日を分けて評価すると、「平均は良いが大事な日に外す」という違いが見えます。予測誤差をそのまま業務損失に置き換えず、余剰在庫と欠品のどちらを減らしたいのかも先に決める必要があります。
IT Postでは、重みだけでなく再現用コードと利用条件を確認できることを評価する。予測モデルは占い師ではない。比較できること、外したときに分かること、現場で回せること。この地味な三つが、派手な順位より長く効く。
AI大手4社が開発速度を意図的に落とすことで合意したとして、米消費者4人がシャーマン法違反で提訴。NVIDIAのフアンCEOの反論とあわせて経緯を確かめた
Alibaba傘下のQwenチームが画像生成・編集モデル「Qwen-Image-2.1」を公開。パラメータ数を200億から70億に削減しつつ、透過画像対応と最大10枚の参照画像編集を可能にした中身を確かめた
Alphabet傘下Intrinsicは2026年9月22日、実際の工場で使う産業用ロボットの基盤ソフトウェアをApache2.0ライセンスで無料公開した。名称は「Intrinsic Core」
NVIDIAは2026年9月22日、GPUを使うロボット開発ツール群の最新版「Isaac ROS 5.0」を発表した。世界で約130万人とするROS利用者にAIエージェント機能などを提供