L

llama.cpp

L
llama.cpp AI

b10333

ggml-cpu : SpaceMiTバックエンド (#26792) の Q5_0 ディスパッチの欠陥を修正する ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) ディSABLED macOS Intel (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x...

L
llama.cpp AI

b10332

ci: rm GGML_HIP_ROCWMMA_FATTN (#26760) サインオフ: Aaron Teo aaron.teo1@ibm.com ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) ディSABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) x Ubuntu64 (OpenVulkan) Ubuntu x64 (SINO...

L
llama.cpp AI

b10331

サーバー: get_info (#26773) から離散作業ディレクトリを報告 サーバー: get_info から離散作業ディレクトリを報告 明確な cwd がなくても、 get_info はツール実行時間が設定されたときでさえ、サーバープロセス作業ディレクトリに戻りました。単離が自社のディレクトリから始まるので 実行できません単離剤を直接要求する。..

L
llama.cpp AI

b10330

CUDA:フィューズ rms_norm + mul + rope (+ view + set_rows) (#26767) CUDA:フィューズ rms_norm + mul + rope (+ view + set_rows) テスト:rms_norm_mul_ropeに放送重量ケースを追加する CUDA:rms_normロープ融合の前にメモリ範囲をチェックする CUDA:ロープセット_ロープ融合のメモリ範囲をチェックする ウェブサイト: https://llama.app macOS/iOS: macOS Apple Silicon (arm64) macOS Apple Silicon (arm64,DIDIAI有効) KleSABLED macOS...

L
llama.cpp AI

b10329

サーバー、UI: ツールが読み込むときにのみ作業ディレクトリを提供します (#26762) 作業ディレクトリチップは、サーバーが内蔵ツールを開くとすぐに表示され、サーバーは get_datetime で起動します。 または、設定ですべてのファイルシステムツールをオフにしたユーザーは、何も読み取れないコントロールを得ています。作業ディレクトリに逆行するかどうかを宣言します

L
llama.cpp AI

b10328

サーバー:初期ツール隔離サポートを追加 (docker を通して) (#26507) サーバー:初期ツール隔離サポートを追加 (docker を通して) docs を追加します get_info py: 修正型contをチェックします tools_io_sandbox / tools_io_docker を分離します sandbox -> x-tool-docker を隔離します --> x-tool-runtime 共同著者: Pascal admin@serveurperso.com ウェブサイト: https://llama.app macOS/iOS: macOS Apple Silicon (arm64) macOS Apple Sil...

L
llama.cpp AI

b10327

CUDA: 量子化CPYカーネル起動でスレッド/ブロック数を修正 (#26731) CUDA: 量子化CPYカーネル起動でスレッド/ブロック数を修正 テスト: 不等式ブロック数を追加するCPYケース ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) 障害 macOS Intel (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64...

L
llama.cpp AI

b10326

tts: タイムライン (#26733) の vocoder パスについて get_output は、パイプラインがそれに延期する波形作業を、モデルに応じて単一のトラッキングウィンドウから完全なパスまで実行します。計測すると 報告された総数と 音声と処理比率が 正確になりますウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効)

L
llama.cpp AI

b10322

sycl: ssm_conv ウィンドウロード (#26612) を結合する テストバックエンド-ops perf -o SSM_CONV Arc Pro B70 で、マスターに対してA/Bを交わし、 6 回、 us/run: ne_a=[515,3328,1,1] ne_b=[4,3328,1,1] n_t=512 97.68 -> 52.95 1.85x ne_a=[937,8192,1,1] ne_b=[4,8192,1,1] n_t=934 516.16 -> 276.13 1.87x ne_a=[4,3328,1,1] ne_b=[4,3328,1,1] n_t=1 2.73 -> 2.71 Qwen 2735B4_K - 中等 (48 の 64 ...

L
llama.cpp AI

b10321

metal: 部分的なsimdgroup (#26708) を残す行長のためのfix NORM/RMS_NORM ggml_metal_op_norm は、th = std::min ((nth, args.ne00_t) でスレッドグループをサイズし、nth は simdgroup サイズの倍数ではなく残すことができます。カーネルは、クロス-SIMDグループステップで行減算を完了し、最後のSIMDグループの各行が shmem_f32から1つのSIMDグループ部分和を読み取ります。 (tiisg == 0) { shm...

L
llama.cpp AI

b10319

mtmd: longest_edgeを修正する ミニ/マックスピクセル (#26638) を無視する mtmd: longest_edgeを修正する ミニ/マックスピクセルを無視する ニット ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) ディSABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64...

L
llama.cpp AI

b10318

シンクロ: ggml ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) DISABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (SYCL FP16) Android: Android arm64 (CPU) Windows: W...

L
llama.cpp AI

b10313

サーバー: (ルーター) LRUスケジューラー (#26572) を追加する lru_sched ハンドルコアレスシング (req 待機列を残す) テストを追加する ストリームを修正する ケース アドレスレビュー コメント ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) ディSABLED macOS Intel (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm...

L
llama.cpp AI

b10312

サーバー: (ルーター) 忙しいモデル (#26567) を追い出さない ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) ディSABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (SYCL FP16)...

L
llama.cpp AI

b10311

mtmd: Qwen3-TTS 世代 (#26706) の間にテキストストリームを再びフィードすることを停止します。参照実装には相互に排他的なプロンプトレイアウトが2つあります。非ストリーミングモードでは、プレフィールでは、全発音テキストプラスtts_eosがcodec_padで合計され、隠された尾行テキストが単一のtts_pad行に収縮されます。ストリーミングモードでは プリフイルは 最初のテキストトークンと 後ろのロー。..

L
llama.cpp AI

b10310

ggml : aarch64 HWCAPのバックバックを追加し、fp16変数検出 (#25554) を修正 ggml: aarch64 HWCAPのビットが欠落しているためバックバック定義を追加 ggml : aarch64 fp16 CPU変数のために HWCAP_ASIMDHP を必要とする また、 has_fp16_va を has_fp16 に変更し、フィールドは FEAT_FP16 の拡張、スカラー、ベクトル半精度算術をすべて一緒にゲートします。ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (ア。..

L
llama.cpp AI

b10308

Windows MSYS2 UCRT64 環境 (GCC 16.1.0) (#26555) のクラッシュ問題を軽減する ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) 障害 macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYC...

L
llama.cpp AI

b10307

sycl: fix UE4M3 parsing (#25608) NVFP4量子化形式は、単一の UE4M3 バイトに詰め込まれた 16 つの重さの各グループのためのスケーリング因子を格納します。SYCL GPUコードは E4M3 パスを使って これらのスケール値を変換していましたが 署名されていますが これらは署名されていない値ですウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効)

L
llama.cpp AI

b10306

sycl: *gluフラットパス (#26354) テスト: SWIGLU パーフケースを追加SWIGLU を 17408列、512 と 2048 トークン、f16 と f32 に追加し、オペランドが融合し分割されます呼び出した op_* でしか違っていなかったので、op を引数として取り、共通のランチャーを共有します。ブロックサイズは全部で256個で 打ち上げの幾何学は変わらない

L
llama.cpp AI

b10305

sycl: DSv4 OPs: LIGHTNING_INDEXER,DSV4_HC_COMB,DSV4_HC_POST,DSV4_HC_PRE (#26568) をサポートする DSv4 OPs: LIGHTNING_INDEXER,DSV4_HC_COMB,DSV4_HC_POST,DSV4_HC_PREwq 更新 ops.md フォーマット問題修正 ウェブサイト: https://llama.app macOS/iOS: macOS Apple Silicon (arm64) macOS Apple Silicon (arm64,KleidiAI有効) ディSABLED macOS iOS (x64) XFramework Linux: Ubuntu Ub64 (CPU) Ubuntu arm64 (CPU) ...

L
llama.cpp AI

b10303

sycl : 修正エラー エラー OP FLASH_ATTN_EXT on arc770 (#26441) ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) ディSABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (SY...

L
llama.cpp AI

b10301

cuda: 未使用変数/関数 (#26688) の警告を修正する ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) DISABLED macOS Intel (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (SYCL...

L
llama.cpp AI

b10299

metal: kernel_lightning_indexer (#26646) でスレッドグループマトリックス配列インスタンス化を避ける。 MSLでは、スレッドグループ half4x4 のようなマトリックスタイプの配列を宣言すると、MSL マトリックスタイプにはゼロ引数のデフォルトコンストラクタがないため",マッチングコンストラクターがない"コンパイルエラーが発生し、スレッドグループ変数には初期化ができない。この問題を解くには、PODスレッドグループ半配列を宣言して、

L
llama.cpp AI

b10298

mtmd: add chunk save/load function (#26645) mtmd: add chunk save/load function nits add tests rn _MAX --> _COUNT ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64,KleidiAI有効) ディSABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (ROCm 7.2) Ubuntu...

L
llama.cpp AI

b10297

サーバー: /cors-proxy (#26656) の空の応答を修正する ウェブサイト: https://llama.app macOS/iOS: macOS Apple シリコン (arm64) macOS Apple シリコン (arm64, KleidiAI有効) DISABLED macOS Intel (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (SYCL FP16)...

L
llama.cpp AI

b10295

model-loader : 量子化された変形テンソールステップ (#26672) を修正する ウェブサイト: https://llama.app macOS/iOS: macOS アップル シリコン (arm64) macOS アップル シリコン (arm64, KleidiAI有効) DISABLED macOS インテル (x64) iOS XCFramework Linux: Ubuntu x64 (CPU) Ubuntu arm64 (CPU) Ubuntu s390x (CPU) Ubuntu x64 (Vulkan) Ubuntu arm64 (Vulkan) Ubuntu x64 (ROCm 7.2) Ubuntu x64 (OpenVINO) Ubuntu x64 (SYCL FP32) Ubuntu x64 (...

L
llama.cpp AI

b10293

ci: gfx1151の修正 (#26544) を搭載したAMD ROCm CI ci: amd rocmを準備 ci: Aaron Teo aaron.teo1@ibm.com ci: fix editorconfig-checker: Aaron Teo aaron.teo1@ibm.com ci: 修正デバイスは認識されていません: Aaron Teo aaron.teo1@ibm.com ci: gpu-amdをgpu-hipに改名する: Aaron Teo aaron.teo1@ibm.com ci: gpu-hipをgpu-rocmに改名する: Aaron Teo haha

L
llama.cpp AI

b10291

vulkan: DeviceLost ドライバーのエラー (#26371) の原因を診断するためのデバッグツールを追加する。 vulkan: DeviceLost エラーの修正についてより多くの情報を得るためのデバッグツールを追加する。

L
llama.cpp AI

b10290

mtmd/ggml: add ggml_build_forward_order (#26649) ggml: add ggml_build_forward_order ggml_build_forward_expandは、テンソールとそのすべての祖先を計算のためにマークし、それを純粋な順序提示として使用する (q,k,vを一緒に保持する) が ggml_build_forward_selectを倒す。未選択のブランチは、アップロードされていない入力で実行するように強制される。音声グラフでは、GEN_WAVの呼び出しが実行されます。

L
llama.cpp AI

b10289

サーバ: file_glob_search ディレクトリウォーク (#26626) を硬化する サーバ: file_glob_search std::filesystem での Windows 接続をウォークしないでください 接続は単純なディレクトリとして報告されるので、シンブルリンクガードがそれを見逃し、先祖を指す接続は、経路の長さが返されるまでウォークされます。