ΠΠ ΠΈ Π΄Π°Π½Π½ΡΠ΅
π Data Scientist Π² ΠΊΠΎΠΌΠ°Π½Π΄Ρ LLM Core, ΠΠ²ΠΈΡΠΎ
ΠΠΎΠΌΠΏΠ°Π½ΠΈΡ Π½Π΅ ΡΠΊΠ°Π·Π°Π½Π° Β· ΠΠ΅ ΡΠΊΠ°Π·Π°Π½ΠΎ Β· ΠΠΈΠ±ΡΠΈΠ΄
ΠΠ°ΡΠΏΠ»Π°ΡΠ° Π½Π΅ ΡΠΊΠ°Π·Π°Π½Π°
π Data Scientist Π² ΠΊΠΎΠΌΠ°Π½Π΄Ρ LLM Core, ΠΠ²ΠΈΡΠΎ π Π£Π΄Π°Π»ΡΠ½ΠΊΠ° / Π³ΠΈΠ±ΡΠΈΠ΄ π Π‘ΠΎΠ·Π΄Π°Π½ΠΈΠ΅ ΠΈ ΡΠ°Π·Π²ΠΈΡΠΈΠ΅ ΡΠΎΠ±ΡΡΠ²Π΅Π½Π½ΡΡ Π±Π°Π·ΠΎΠ²ΡΡ ΡΠ·ΡΠΊΠΎΠ²ΡΡ ΠΌΠΎΠ΄Π΅Π»Π΅ΠΉ ΠΠ²ΠΈΡΠΎ: ΠΏΡΠΎΠ²Π΅ΡΠΊΠ° Π³ΠΈΠΏΠΎΡΠ΅Π· Π² ΠΎΠ±Π»Π°ΡΡΠΈ ΠΏΡΠ΅ΡΡΠ΅ΠΉΠ½Π°, continual pre-training, post-training, RL ΠΈ ΡΠΈΠ½ΡΠ΅ΡΠΈΡΠ΅ΡΠΊΠΈΡ Π΄Π°Π½Π½ΡΡ , ΠΌΠ°ΡΡΡΠ°Π±ΠΈΡΠΎΠ²Π°Π½ΠΈΠ΅ ΠΎΠ±ΡΡΠ΅Π½ΠΈΡ ΠΈ ΠΎΠΏΡΠΈΠΌΠΈΠ·Π°ΡΠΈΡ ΠΈΠ½ΡΠ΅ΡΠ΅Π½ΡΠ° (ΠΊΠ²Π°Π½ΡΠΎΠ²Π°Π½ΠΈΠ΅, speculative decoding), ΠΏΠΎΡΡΡΠΎΠ΅Π½ΠΈΠ΅ ΠΏΡΠΎΡΠ΅Π΄ΡΡ ΠΎΡΠ΅Π½ΠΊΠΈ ΠΊΠ°ΡΠ΅ΡΡΠ²Π° ΠΌΠΎΠ΄Π΅Π»Π΅ΠΉ, Π½Π°ΠΏΠΈΡΠ°Π½ΠΈΠ΅ ΠΏΡΠΎΠ΄Π°ΠΊΡΠ΅Π½-ΠΊΠΎΠ΄Π° Π½Π° Python ΠΈ PyTorch. πΌ 3+ Π³ΠΎΠ΄Π° ΠΎΠΏΡΡΠ° ΡΠ°Π·ΡΠ°Π±ΠΎΡΠΊΠΈ ΠΈ ΡΠΊΡΠΏΠ»ΡΠ°ΡΠ°ΡΠΈΠΈ ML-ΡΠ΅ΡΠ΅Π½ΠΈΠΉ, Π³Π»ΡΠ±ΠΎΠΊΠΎΠ΅ ΠΏΠΎΠ½ΠΈΠΌΠ°Π½ΠΈΠ΅ Transformer ΠΈ ΠΏΡΠΈΠ½ΡΠΈΠΏΠΎΠ² ΠΎΠ±ΡΡΠ΅Π½ΠΈΡ LLM, ΠΏΡΠ°ΠΊΡΠΈΡΠ΅ΡΠΊΠΈΠΉ ΠΎΠΏΡΡ ΠΎΠ±ΡΡΠ΅Π½ΠΈΡ ΠΈ Π²Π½Π΅Π΄ΡΠ΅Π½ΠΈΡ NLP-ΠΌΠΎΠ΄Π΅Π»Π΅ΠΉ, ΡΠ²Π΅ΡΠ΅Π½Π½ΡΠΉ Python ΠΈ PyTorch, ΠΏΠΎΠ½ΠΈΠΌΠ°Π½ΠΈΠ΅ ΠΊΠΎΠΌΠΏΡΠΎΠΌΠΈΡΡΠΎΠ² ΠΌΠ΅ΠΆΠ΄Ρ ΠΊΠ°ΡΠ΅ΡΡΠ²ΠΎΠΌ, latency ΠΈ ΡΡΠΎΠΈΠΌΠΎΡΡΡΡ. ΠΠ»ΡΡΠΎΠΌ: continual pre-training, SFT/LoRA/RL, DeepSpeed, vLLM, TensorRT-LLM, MLOps-ΠΈΠ½ΡΡΡΡΠΌΠ΅Π½ΡΡ. ΠΡΠΊΠ»ΠΈΠΊΠ½ΡΡΡΡΡ Π½Π° Π²Π°ΠΊΠ°Π½ΡΠΈΡ βββ ΠΠ΅ ΠΏΠΎΠ΄ΠΎΡΠ»Π° Π²Π°ΠΊΠ°Π½ΡΠΈΡ? ΠΠΎΠ΄Π΅Π»ΠΈΡΡ Ρ ΡΠ΅ΠΌ, ΠΊΠΎΠΌΡ ΠΏΡΠΈΠ³ΠΎΠ΄ΠΈΡΡΡ β‘οΈ
ΠΠ°ΡΠ° ΠΎΠ±ΡΡΠ²Π»Π΅Π½ΠΈΡ: . ΠΡΠΎΠ²Π΅ΡΡ Π°ΠΊΡΡΠ°Π»ΡΠ½ΡΠ΅ ΡΡΠ»ΠΎΠ²ΠΈΡ Π² ΠΏΠ΅ΡΠ²ΠΎΠΈΡΡΠΎΡΠ½ΠΈΠΊΠ΅.