llama.cpp

Artificial Intelligence

早速Intel ARCがトラブった件

おいマジか勘弁してくれ事案発生ある日アクセスしようとしたところですね、サーバが固まってるんすよ。こんなログ吐いて。ERROR CRITICAL: Xe has declared device 0000:03:00.0 as wedged.E...
Artificial Intelligence

てんやわんやの大改造-GPUの組み替え

WindowsマシンからLinuxマシンへの転換を図るあれからWindowsマシンにIntel ARC PRO B70を入れて動かし始めたわけですが、ここで悲劇が一つ起きましたです。なんと、Windowsの地雷を踏みました。それはこれ。引用...
Artificial Intelligence

Intel ARC PRO B70をのっけた。そして・・

Intel ARC PRO B70着荷しました。2026年9月2日水曜日。来ました来ました。お荷物が。Intel ARC PRO B70でございます。開梱しますと、内容はこんな風になっておりました。1つは本体、1つは 8pin x2→12p...
Artificial Intelligence

Qwen3.8-27Bに触れた

待望のSLMとなるか?Qwen3.8のコンパクトモデル登場!まさかの2026年8月15日、終戦記念日の午前0時にリリースされました、Qwen3.8-27Bでございます。これより前に登場したQwen3.8-Maxに相当するんじゃないかと言われ...
Artificial Intelligence

Gemma-4-12b-it Audio Transcriptを試す

Llama.cpp付属のWeb-UIで実現可能Gemma-4-12b-itでは、それまで外付けエンコーダーを必要としていたものがモデルの中に組み込まれ、特に意識することなくオーディオ書き取りが行えます。私がオーディオ書き取りの機能をモデルを...
Artificial Intelligence

勉強会なるものに行ってきたよ!

オフサイトで勉強会に行くのは何年ぶりだろうかこれに行ってきましたです。開発者視点のローカルLLMはどう見えてるのか?と言うのが気になりました。福岡でも有名なエンジニアさんであるきしだ(@kis)さんが主宰されており、会場は博多駅から近いLI...
Artificial Intelligence

RTX3060とGemma-4-12b

GeForce RTX 3060は意外にやる子過日、まさかの3万YEN切る価格で入手したRTX 3060ですが、実は以前会社員時代に最初に会社で購入したGPUでもあります。2022年当時の相場だとおよそ80,000JPYでしたね。このころは...
Artificial Intelligence

論文翻訳品質確認をしてみたよ。

Hy-MT2-1.8Bの実力を測ってみたTencentが公開した中で、軽量モデルであるHy-MT2-1.8Bについて評価をしてみました。Tencentは中国企業の中でもかなり初期段階からDeepLearningの画像系処理でもろもろ取り組ん...
Artificial Intelligence

AIとの向き合い方は人それぞれ+ご挨拶

時々X.comを見てみると初めまして。ゆういと申します。今や気づけばいろんな人がAIと向き合ってああでもない、こうでもないとか、中にはAPI型こそ至高!いやいや、ローカルLLMこそ究極!なんぞおいしんぼならぬAIんぼみたいな展開になってると...