6 月 17 日 回复了 cheman 创建的主题 › 程序员 › 公司想搞本地化算力部署 deepseek coder v2 给技术用,听到 AMD 锐龙 AI Halo 也不算贵,可行么 |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 15 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 12 日 回复了 Livid 创建的主题 › Local LLM › DiffusionGemma |
6 月 12 日 回复了 pz886 创建的主题 › 职场话题 › 25 岁专科女生,求网友指路 |
6 月 12 日 回复了 sentinelK 创建的主题 › Local LLM › lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 |
6 月 12 日 回复了 sentinelK 创建的主题 › Local LLM › lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 |
6 月 12 日 回复了 sentinelK 创建的主题 › Local LLM › lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 |
6 月 9 日 回复了 zzutmebwd 创建的主题 › Local LLM › 关于低算力 gpu 推理时 prefill 在总时长中的占比问题 |
6 月 9 日 回复了 zzutmebwd 创建的主题 › Local LLM › 关于低算力 gpu 推理时 prefill 在总时长中的占比问题 |
6 月 9 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 9 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 9 日 回复了 mingtdlb 创建的主题 › Local LLM › 现在大模型主流都用哪些 nVidia GPU? |
6 月 9 日 回复了 Flagship9945 创建的主题 › Local LLM › 需要购买国产显卡本地部署大模型,哪家的比较好 |