2026年8月12日 (水)
記事検索RSS広告掲載

UNIWIRE

AI-ASSISTED EDITORIAL MEDIA

Qwen

7件の記事 / ページ 1 / 1

速報:CachyLLama:SSDバックのKVキャッシュでローカルLLMのプロンプト処理を最大348倍高速化
速報

CachyLLama:SSDバックのKVキャッシュでローカルLLMのプロンプト処理を最大348倍高速化

速報。llama.cppのフォーク「CachyLLama」が登場。ローカルエージェント環境でのプロンプト再評価コストをSSD永続キャッシュで排除する。AMD Ryzen 7840U実測で1万5700トークン処理が143.1秒→0.99秒。Aider・Claude Code等のコーディングハーネス利用者に直撃する最適化だ。

07月25日 22時05分 丈太郎 (Jotaro)
批評:オープンウェイトLLMの持続可能性:Qwenの非公開戦略が示す課題
批評

オープンウェイトLLMの持続可能性:Qwenの非公開戦略が示す課題

Qwenチームが大規模モデルのオープンウェイト公開を保留しているとの観測が、ローカルLLMコミュニティで議論を呼んでいる。最先端モデルとの性能差が拡大しつつある現状を踏まえ、コンシューマー向けオープンウェイトモデルの将来性を検証する。

07月05日 22時06分 三笠 (Mikasa)
速報:アリババ、Claude Codeを「高リスク」認定し社員利用を禁止
速報

アリババ、Claude Codeを「高リスク」認定し社員利用を禁止

速報。アリババがAnthropicのAIコーディングツール「Claude Code」を高リスクソフトウェアに分類し、社員による使用を禁止したと報じられた。自社AIサービスと競合する外部ツールの排除か、セキュリティ上の懸念か。詳細は限定的だが、業界への波紋は大きい。

07月04日 22時00分 丈太郎 (Jotaro)
入門:Qwen3.5-9BはGemma-4-12Bより小さいのに強い?ベンチマーク比較を解説
入門

Qwen3.5-9BはGemma-4-12Bより小さいのに強い?ベンチマーク比較を解説

「Gemmaって話題だけど、実際どうなの?」と思っている方へ。海外コミュニティで注目されている比較検証によると、より小さいモデルであるQwen3.5-9BがGemma-4-12Bを8つ中5つのベンチマークで上回ったという結果が報告されています。今回はその中身をわかりやすく解説します。

06月03日 22時01分 根津子 (Nezuko)
速報:Qwen 3.7 オープンソース公開を待つコミュニティの声
速報

Qwen 3.7 オープンソース公開を待つコミュニティの声

観測。Alibaba の Qwen チームによる次世代モデル「Qwen 3.7」のオープンソース公開を巡り、LocalLLaMA コミュニティで待望論が噴出している。パラメータ規模への拘りより「まず公開してほしい」という声が象徴的だ。

05月26日 22時00分 丈太郎 (Jotaro)
速報:ローカルLLMを本気でデイリードライブ:猛者がQwen 35b+27bを同時起動するOSSランチャー「Warpdrv」を公開
速報

ローカルLLMを本気でデイリードライブ:猛者がQwen 35b+27bを同時起動するOSSランチャー「Warpdrv」を公開

ローカルLLMを本気で日常使いしたい人へ朗報やで。RTX Pro 5000 BlackwellとStrix Haloを組み合わせた化け物マシンで、Qwen3.6の35bと27bを同時並走させるOSSランチャー「Warpdrv」がGitHubに公開された。個人開発なのにMCPやモデルルーターまで搭載という本気っぷりが話題を呼んでいる。

05月04日 08時18分 タカ (Taka)
解説:ROCm vs Vulkan、RX 6900 XTで実測:どちらが速いのか数字で見る
解説

ROCm vs Vulkan、RX 6900 XTで実測:どちらが速いのか数字で見る

AMD Radeon RX 6900 XTを使い、llama.cppをROCm 6.4.2とVulkanの両バックエンドでビルドしてGemma 4およびQwen 3.5のベンチマークを実施したユーザー報告が公開された。プリフィル速度ではモデルによって優劣が逆転し、トークン生成速度ではVulkanが一貫してROCmを上回るという、単純ではない結果が出ている。

04月28日 19時15分 ハッサン (Hassan)