<bgdev />free

Вход Регистрация

Лаптоп за Deep Learning и Large Language модели
0

0 1 2 3 4 ...47 48 49 50 51 ...95 96 97 98 99

#189575 (ツ) Реконструктор
Създадено на 05.09.2026 , видяно: 209 пъти.
|

Имаш два чиплета, всеки с memory controller и нямат връзка с пълен bandwidth на меша между чиплетите. За половината ядра имат по-бърза връзка до паметта вързана за техния memory controller отколкото до другата памет. Защото достъпа домдругата памет трябва да мине през бавния бридж между чиплетите.

Ма къде има такива лаптопи?

#189583 (ツ) |
Създадено на 05.09.2026 , видяно: 191 пъти.
janbird

Съвременните макове не използват ACPI таблици.

Съвременнните макове нямат NUMA.

#189584 (ツ) |
Създадено на 05.09.2026 , видяно: 183 пъти.
Реконструктор

Ма къде има такива лаптопи?

Ами доколкото знам никой освен Апъл не слага паметта в един "чип" с процесорите. Както вече казах, зависи от връзката между чиповете. Апъл твърдят, че е 4.4 TB/s, но не казват нищо за latency. Апъл никога не са правили NUMA, така че се съмнявам да направят и в бъдеще. Напълно способни са да направят моста достатъчно бърз и да не се занимават с глупости.

#189649 (ツ) Baj_boeb
Създадено на 07.09.2026 , видяно: 116 пъти.

My picture
Attached files:
FileSizeUploadedDownloadsMD5 hash
1788775395403323.png13165 bytes07.09.202629b1e2e39b2f96d894cace2084a1009d2e
#189732 (ツ) waldorf
Последно редактирано на 23:55 от waldorf, видяно: 76 пъти.

https://codeberg.org/ggz14/radiance-vllm-mxfp4

Това направо ме разби. От 20-30 ток/с отидох на 100-150 ... точно се бях разочаровал от R9700 и той взе, че изкара скорост почти като RTX5090 само, че на 1/3 от цената ... и цената веднага скочи. Добре, че имаше останали в Амазоня още 2 ГПУ-та на старата цена, че ги докарах то 4

#189733 (ツ) BIGBUGEX
Създадено на 00:00 , видяно: 73 пъти.
waldorf

https://codeberg.org/ggz14/radiance-vllm-mxfp4

Това направо ме разби. От 20-30 ток/с отидох на 100-150 ... точно се бях разочаровал от R9700 и той взе, че изкара скорост почти като RTX5090 само, че на 1/3 от цената ... и цената веднага скочи. Добре, че имаше останали в Амазоня още 2 ГПУ-та на старата цена, че ги докарах то 4

О, акциите на амд шса качат значи.

#189737 (ツ) |
Последно редактирано на 00:42 от |, видяно: 64 пъти.
waldorf

https://codeberg.org/ggz14/radiance-vllm-mxfp4

Това направо ме разби. От 20-30 ток/с отидох на 100-150 ... точно се бях разочаровал от R9700 и той взе, че изкара скорост почти като RTX5090 само, че на 1/3 от цената ... и цената веднага скочи. Добре, че имаше останали в Амазоня още 2 ГПУ-та на старата цена, че ги докарах то 4

100-150 за какъв модел и какъв размер на контекста.

#189750 (ツ) Реконструктор
Създадено на 03:56 , видяно: 47 пъти.
#189756 (ツ) waldorf
Последно редактирано на 06:46 от waldorf, видяно: 37 пъти.
|

100-150 за какъв модел и какъв размер на контекста.

Qwen 3.8 27B 256k Q8

#189757 (ツ) waldorf
Създадено на 06:42 , видяно: 36 пъти.
#189764 (ツ) Baj_boeb
Създадено на 09:24 , видяно: 22 пъти.

My picture
Attached files:
FileSizeUploadedDownloadsMD5 hash
1788914322275651.png485872 bytes09.09.20269e258d0e33779314943dc4ab3f997479e
#189771 (ツ) |
Създадено на 11:43 , видяно: 12 пъти.
waldorf

Qwen 3.8 27B 256k Q8

Не питам какъв е максималния контекст, а на какъв контекст си мерил толкова ток/с. Производителността намалява с увеличаването на размера на контекста.

#189772 (ツ) waldorf
Създадено на 11:53 , видяно: 7 пъти.

От чисто празен контекст до почти пълен - около 200к - падна от 140 до 80-90 т/с.

Но не беше контролиран експеримент - товарих го до прави сумарита на големи дискусии в хакер нюз докато му пррпълни контекста.

#189773 (ツ) |
Създадено на 11:54 , видяно: 5 пъти.

0 1 2 3 4 ...47 48 49 50 51 ...95 96 97 98 99

Лаптоп за Deep Learning и Large Language модели
0

AsmBB v3.0 (check-in: 2fb30f0a060190b0); SQLite v3.53.0 (check-in: 4525003a53a7fc63);
©2016..2024 John Found; Licensed under EUPL. Powered by Assembly language Created with Fresh IDE