ローカルLLM運用

オープンウェイトモデルのローカル実行、並列数、GPU、KVキャッシュ、メモリ制約を扱う。

「ローカルLLM運用」を全文検索でも探す →

トピックを検索中…

一致するトピックはありません。

LISTENverse

拡大するとさらに表示 · 0 本

63【圧倒的な速さ】DeepSeek-V4.1-Flashの実力

AI駆動開発部の日常

DeepSeek V4.1 Flashの速さと実用性について、GLM 5.3 Flashとの比較を交えながら話す。フロントエンド実装では、GLMで約2日かかったタスクをDeepSeekが半日ほどで終え、268TPS前後という測定結果も紹介された。画像入力への対応やデザイン実装の評価、ローカル実行の可能性にも触れる一方、並列数やKVキャッシュ、PCメモリ、ハーネスの重さが現...

新型Mac mini M6がAI時代に欠かせない理由と買うべき対象者。

AIで仕事をサボるラジオ

Appleが突如発表したM6チップ搭載の新型Mac miniについて、その性能とAI時代における活用法を解説。M6チップはニューラルエンジンが2基に増え、GPUにもAI回路が搭載されたことで、AI処理能力が大幅に向上しました。記事では、AI開発者や重い作業を家で行うユーザーにMac mini M6を推奨する一方、ローカルLLMを本格的に使うならM5 Pro/Maxチップ...

エピソードを読み込んでいます…