LLM業界に吉野家が現れた——安い・早い・うまいの三拍子で、中国製LLMがフロンティアに迫っています。今日Qwen3.8のミートアップに参加してきて面白かったので、急遽その話をまとめた回です。ただし高級レストランの代わりではなく、「毎日の定食をどこで食べるか」の話。難しい判断はフロンティアに、数をこなす定常業務は安いモデルに、という使い分けです。
今回話していること:
- アリババのQwen3.8シリーズがこの夏出揃った
- Max(8/3): 総パラメータ2.4兆のMoE・コンテキスト100万トークン・入力$2/出力$6
- MoEとは: 専門家チームに分けて必要な専門家だけ動かす省エネの仕組み
- Flash-Next(8/26オープンウェイト): 総125Bで動くのは6Bだけ。51Bの参照表をRAMに置ける設計で、RAM 75GBクラスならGPUなしでも動くという発表
- 27B: 手元で動く小型オープンウェイト。一番人気で私も導入済み
- Artificial Analysisの知能指数で27BがOpenAIの軽量モデルに並ぶ52(セミナー紹介)
- Maxは自社ベンチでOpus 4.8やFable 5を一部項目で上回る——ただし自社計測なので留保
- 使いどころ: 定型チェック・分類・要約などの定常業務。判断が難しい仕事はフロンティアへ
- 日本語は一部ぎこちない声も。失敗が許される業務から
- 管理職の4人に1人が非公認AIに機密入力という調査も——安いモデルを社内設計に組み込みシャドーAI対策の部品に
- 「トークンを使いまくる」から「賢くケチる」フェーズへ
🔗 AIを仕事に取り入れていくSubstack(特典PDFあり):
https://ikkaku.substack.com/
#AI活用 #Qwen #ローカルLLM #中国製LLM #コスト削減