GGUF

スポンサーリンク
対あり技術部(技術系)

Qwen3.8-Flash-Next(検閲なし)をllama.cppでローカル実行する

Qwen3.8-Flash-Nextの検閲なし版モデルをllama.cppでローカル実行する手順を解説します。GGUFファイルのダウンロードからllama-cliでの起動、思考過程の制御やAPIサーバー化までの設定方法をまとめました。
対あり技術部(技術系)

【GPU不要】Qwen3.8-Flash-NextをDDR4メモリだけで動かす

2026年8月26日、AlibabaのQwenチームが「Qwen3.8-Flash-Next」のオープンウェイトを公開しました。次期Qwen4ファミリーで使われる新アーキテクチャの先行公開版という位置づけで、総パラメータ125B(アクティブ...
Blog

Gemma 4 + Ollama でローカルAIを動かす完全ガイド

はじめにGoogle DeepMindが公開したGemma 4は、Gemini 3の研究と技術を基に構築された最先端のオープンモデルです。この記事では、ローカル環境で簡単にLLMを実行できるOllamaを使って、Gemma 4を導入する方法...
Blog

Qwen3.5(検閲なし)+ Ollama でローカルAIを動かす完全ガイド

通常のQwen3.5はこちら本記事では、HauhauCS が公開している検閲なし(Uncensored)の大規模言語モデル Qwen3.5-9B-Uncensored-HauhauCS-Aggressive を、Ollama を使ってローカ...
スポンサーリンク