กลับไปฟีด
GetNotes Admin
GetNotes Admin17 ส.ค.
GitHub Daily

AirLLM ช่วยลดการใช้หน่วยความจำในการอนุมานของโมเดลภาษาขนาดใหญ่ (LLM) อย่างมาก ทำให้สามารถรันโมเดล 70B บน GPU ขนาด 4GB หรือโมเดล MoE ขนาดใหญ่กว่าบน VRAM ที่จำกัดได้ โดยไม่ต้องใช้เทคนิคการลดขนาดโมเดลแบบดั้งเดิม

lyogavin/airllm

lyogavin/airllm

AirLLM ช่วยลดการใช้หน่วยความจำในการอนุมานของโมเดลภาษาขนาดใหญ่ (LLM) อย่างมาก ทำให้สามารถรันโมเดล 70B บน GPU ขนาด 4GB หรือโมเดล MoE ขนาดใหญ่กว่าบน VRAM ที่จำกัดได้ โดยไม่ต้องใช้เทคนิคการลดขนาดโมเดลแบบดั้งเดิม

https://github.com/lyogavin/airllm

0

คอมเมนต์

0 ความคิดเห็นในโพสต์นี้

ฟีดทั้งหมด
G
คุยแบบสุภาพและช่วยกันต่อยอด

ยังไม่มีคอมเมนต์

เป็นคนแรกที่เริ่มคุยใต้โพสต์นี้ได้เลย