『LLM業界に吉野家が現れた|Qwen3.8は安い・早い・うまい』のカバーアート

LLM業界に吉野家が現れた|Qwen3.8は安い・早い・うまい

LLM業界に吉野家が現れた|Qwen3.8は安い・早い・うまい

無料で聴く

ポッドキャストの詳細を見る
LLM業界に吉野家が現れた——安い・早い・うまいの三拍子で、中国製LLMがフロンティアに迫っています。今日Qwen3.8のミートアップに参加してきて面白かったので、急遽その話をまとめた回です。ただし高級レストランの代わりではなく、「毎日の定食をどこで食べるか」の話。難しい判断はフロンティアに、数をこなす定常業務は安いモデルに、という使い分けです。 今回話していること: - アリババのQwen3.8シリーズがこの夏出揃った - Max(8/3): 総パラメータ2.4兆のMoE・コンテキスト100万トークン・入力$2/出力$6 - MoEとは: 専門家チームに分けて必要な専門家だけ動かす省エネの仕組み - Flash-Next(8/26オープンウェイト): 総125Bで動くのは6Bだけ。51Bの参照表をRAMに置ける設計で、RAM 75GBクラスならGPUなしでも動くという発表 - 27B: 手元で動く小型オープンウェイト。一番人気で私も導入済み - Artificial Analysisの知能指数で27BがOpenAIの軽量モデルに並ぶ52(セミナー紹介) - Maxは自社ベンチでOpus 4.8やFable 5を一部項目で上回る——ただし自社計測なので留保 - 使いどころ: 定型チェック・分類・要約などの定常業務。判断が難しい仕事はフロンティアへ - 日本語は一部ぎこちない声も。失敗が許される業務から - 管理職の4人に1人が非公認AIに機密入力という調査も——安いモデルを社内設計に組み込みシャドーAI対策の部品に - 「トークンを使いまくる」から「賢くケチる」フェーズへ 🔗 AIを仕事に取り入れていくSubstack(特典PDFあり): https://ikkaku.substack.com/ #AI活用 #Qwen #ローカルLLM #中国製LLM #コスト削減 --- stand.fmでは、この放送にいいね・コメント・レター送信ができます。 https://stand.fm/channels/695826926f1e5aedb1ead45c
adbl_web_anon_alc_button_suppression_t1
まだレビューはありません