Ë
    l^(hÕM  ã                  óê   — d dl mZ d dlmZmZ d dlmZ d dlmZ d dl	m
Z
mZ d dlZd dlZd dlmZmZ d dlmZmZ d d	lmZ d d
lmZmZ  G d„ d«      Z	 	 	 	 	 	 	 	 dd„Z G d„ dej4                  «      Zy)é    )Úannotations)ÚIterableÚIterator)Únullcontext)Úpartial)ÚAnyÚLiteralN)ÚTensorÚnn)Úget_device_statesÚset_device_states)ÚSentenceTransformer)ÚStaticEmbeddingÚTransformerc                  ó(   — e Zd ZdZdd„Zdd„Zdd„Zy)ÚRandContexta  
    Random-state context manager class. Reference: https://github.com/luyug/GradCache.

    This class will back up the pytorch's random state during initialization. Then when the context is activated,
    the class will set up the random state with the backed-up one.
    c                ó`   — t        j                  «       | _        t        |Ž \  | _        | _        y ©N)ÚtorchÚget_rng_stateÚfwd_cpu_stater   Úfwd_gpu_devicesÚfwd_gpu_states)ÚselfÚtensorss     ún/var/www/skyplay_api_hub/venv/lib/python3.12/site-packages/sentence_transformers/losses/CachedGISTEmbedLoss.pyÚ__init__zRandContext.__init__   s(   € Ü"×0Ñ0Ó2ˆÔÜ4EÀwÐ4OÑ1ˆÔ˜dÕ1ó    c                ó  — t         j                  j                  | j                  d¬«      | _        | j                  j                  «        t        j                  | j                  «       t        | j                  | j                  «       y )NT)ÚdevicesÚenabled)
r   ÚrandomÚfork_rngr   Ú_forkÚ	__enter__Úset_rng_stater   r   r   ©r   s    r   r%   zRandContext.__enter__   s^   € Ü—\‘\×*Ñ*°4×3GÑ3GÐQUÐ*ÓVˆŒ
Ø�
‰
×ÑÔÜ×Ñ˜D×.Ñ.Ô/Ü˜$×.Ñ.°×0CÑ0CÕDr   c                óL   — | j                   j                  |||«       d | _         y r   )r$   Ú__exit__)r   Úexc_typeÚexc_valÚexc_tbs       r   r)   zRandContext.__exit__#   s   € Ø�
‰
×Ñ˜H g¨vÔ6Øˆ�
r   N)ÚreturnÚNone)Ú__name__Ú
__module__Ú__qualname__Ú__doc__r   r%   r)   © r   r   r   r      s   „ ñóPóEôr   r   ÚCachedGISTEmbedLossc           
     óÄ  — |j                   €J ‚|j                  €J ‚t        j                  «       5  t	        ||j                   |j                  «      D ]v  \  }}}t	        |j                  |dd|¬«      |«      D ]N  \  \  }}}}t        j                  |j                  «       |j                  «       «      | z  }	|	j                  «        ŒP Œx 	 ddd«       y# 1 sw Y   yxY w)zOA backward hook to backpropagate the cached gradients mini-batch by mini-batch.NTF)Úsentence_featureÚ	with_gradÚcopy_random_stateÚrandom_states)	Úcacher9   r   Úenable_gradÚzipÚembed_minibatch_iterÚdotÚflattenÚbackward)
Úgrad_outputÚsentence_featuresÚloss_objr6   Úgradr9   Úreps_mbÚ_Úgrad_mbÚ	surrogates
             r   Ú_backward_hookrI   (   sç   € ð �>‰>Ð%Ð%Ð%Ø×!Ñ!Ð-Ð-Ð-Ü	×	Ñ	Ó	ñ %Ü58Ð9JÈHÏNÉNÐ\d×\rÑ\rÓ5sò 	%Ñ1Ð˜d MÜ,/Ø×-Ñ-Ø%5Ø"Ø&+Ø"/ð	 .ó ð ó-ò 
%Ñ(‘�˜!˜Q ô "ŸI™I g§o¡oÓ&7¸¿¹Ó9JÓKÈkÑY�	Ø×"Ñ"Õ$ñ
%ñ	%÷%÷ %ñ %ús   ±BCÃCc                  óÈ   ‡ — e Zd Z	 	 	 	 	 d		 	 	 	 	 	 	 	 	 	 	 	 	 	 	 d
ˆ fd„Zdd„Z	 d	 	 	 	 	 	 	 	 	 	 	 	 	 dd„Z	 d	 	 	 	 	 	 	 	 	 dd„Zdd„Z	 d	 	 	 	 	 	 	 dd„Zdd„Z	dd„Z
ˆ xZS )r4   c                ó˜  •— t         ‰| �  «        t        |d   t        «      rt	        d«      ‚|| _        || _        || _        t        j                  d¬«      | _
        t        |d   t        «      rt        |d   t        «      st	        d«      ‚t        j                  «       | _        || _        d| _        d| _        || _        |j$                  j&                  |j$                  j&                  k7  xs |j(                  |j(                  k  | _        | j*                  r|j$                  | _        |dvrt	        d«      ‚|| _        || _        y)	a¨  
        This loss is a combination of :class:`GISTEmbedLoss` and :class:`CachedMultipleNegativesRankingLoss`.
        Typically, :class:`MultipleNegativesRankingLoss` requires a larger batch size for better performance.
        :class:`GISTEmbedLoss` yields stronger training signals than :class:`MultipleNegativesRankingLoss` due to the
        use of a guide model for in-batch negative sample selection. Meanwhile, :class:`CachedMultipleNegativesRankingLoss`
        allows for scaling of the batch size by dividing the computation into two stages of embedding and loss
        calculation, which both can be scaled by mini-batches (https://arxiv.org/pdf/2101.06983.pdf).

        By combining the guided selection from :class:`GISTEmbedLoss` and Gradient Cache from
        :class:`CachedMultipleNegativesRankingLoss`, it is possible to reduce memory usage while maintaining performance
        levels comparable to those of :class:`GISTEmbedLoss`.

        You can apply different false-negative filtering strategies to discard hard negatives that are too similar to
        the positive. Two strategies are supported:

            - "absolute": Discards negatives whose similarity score is greater than or equal to ``positive_score - margin``.
            - "relative": Discards negatives whose similarity score is greater than or equal to ``positive_score * (1 - margin)``.

        Args:
            model: SentenceTransformer model
            guide: SentenceTransformer model to guide the in-batch negative sample selection.
            temperature: Temperature parameter to scale the cosine similarities.
            mini_batch_size: Mini-batch size for the forward pass, this denotes how much memory is actually used during
                training and evaluation. The larger the mini-batch size, the more memory efficient the training is, but
                the slower the training will be. It's recommended to set it as high as your GPU memory allows. The default
                value is 32.
            show_progress_bar: If True, a progress bar for the mini-batches is shown during training. The default is False.
            margin_strategy: Strategy used for false negative filtering. One of {"absolute", "relative"}.
            margin: The margin value for filtering negatives. Defaults to 0.0, together with the "absolute" strategy,
                this only removes negatives that are more similar to the query than the positive is to the query.

        References:
            - Efficient Natural Language Response Suggestion for Smart Reply, Section 4.4: https://arxiv.org/pdf/1705.00652.pdf
            - Scaling Deep Contrastive Learning Batch Size under Memory Limited Setup: https://arxiv.org/pdf/2101.06983.pdf
            - GISTEmbed: Guided In-sample Selection of Training Negatives for Text Embedding Fine-tuning https://arxiv.org/abs/2402.16829

        Requirements:
            1. (anchor, positive) pairs or (anchor, positive, negative pairs)
            2. Should be used with large batch sizes for superior performance, but has slower training time than :class:`MultipleNegativesRankingLoss`

        Inputs:
            +-------------------------------------------------+--------+
            | Texts                                           | Labels |
            +=================================================+========+
            | (anchor, positive) pairs                        | none   |
            +-------------------------------------------------+--------+
            | (anchor, positive, negative) triplets           | none   |
            +-------------------------------------------------+--------+
            | (anchor, positive, negative_1, ..., negative_n) | none   |
            +-------------------------------------------------+--------+

        Recommendations:
            - Use ``BatchSamplers.NO_DUPLICATES`` (:class:`docs <sentence_transformers.training_args.BatchSamplers>`) to
              ensure that no in-batch negatives are duplicates of the anchor or positive samples.

        Relations:
            - Equivalent to :class:`GISTEmbedLoss`, but with caching that allows for much higher batch sizes

        Example:
            ::

                from sentence_transformers import SentenceTransformer, SentenceTransformerTrainer, losses
                from datasets import Dataset

                model = SentenceTransformer("microsoft/mpnet-base")
                guide = SentenceTransformer("all-MiniLM-L6-v2")
                train_dataset = Dataset.from_dict({
                    "anchor": ["It's nice weather outside today.", "He drove to work."],
                    "positive": ["It's so sunny.", "He took the car to the office."],
                })
                loss = losses.CachedGISTEmbedLoss(
                    model,
                    guide,
                    mini_batch_size=64,
                    margin_strategy="absolute",   # or "relative" (e.g., margin=0.05 for max. 95% of positive similarity)
                    margin=0.1
                )

                trainer = SentenceTransformerTrainer(
                    model=model,
                    train_dataset=train_dataset,
                    loss=loss,
                )
                trainer.train()
        r   zˆCachedGISTEmbedLoss is not compatible with a SentenceTransformer model based on a StaticEmbedding. Consider using GISTEmbedLoss instead.éÿÿÿÿ©Údimz_Both the training model and the guiding model must be based on the `transformers` architecture.N)ÚabsoluteÚrelativez1margin_strategy must be 'absolute' or 'relative'.)Úsuperr   Ú
isinstancer   Ú
ValueErrorÚmodelÚguideÚtemperaturer   ÚCosineSimilarityÚsimilarity_fctr   ÚCrossEntropyLossÚcross_entropy_lossÚmini_batch_sizer:   r9   Úshow_progress_barÚ	tokenizerÚvocabÚmax_seq_lengthÚmust_retokenizeÚmargin_strategyÚmargin)	r   rT   rU   rV   r[   r\   ra   rb   Ú	__class__s	           €r   r   zCachedGISTEmbedLoss.__init__@   s.  ø€ ô~ 	‰ÑÔÜ�e˜A‘h¤Ô0Üð8óð ð ˆŒ
ØˆŒ
Ø&ˆÔÜ ×1Ñ1°bÔ9ˆÔÜ˜% ™(¤KÔ0¼
À5ÈÁ8Ì[Ô8YÜØqóð ô #%×"5Ñ"5Ó"7ˆÔØ.ˆÔØ04ˆŒ
Ø=AˆÔØ!2ˆÔà�O‰O×!Ñ! U§_¡_×%:Ñ%:Ñ:Òi¸e×>RÑ>RÐUZ×UiÑUiÑ>ið 	Ôð ×ÒØ"Ÿ_™_ˆDŒNØÐ":Ñ:ÜÐPÓQÐQØ.ˆÔØˆ�r   c                ób   — | j                  |j                  d«      |j                  d«      «      S )Né   r   )rX   Ú	unsqueeze)r   Úembed1Úembed2s      r   Ú
sim_matrixzCachedGISTEmbedLoss.sim_matrix¼   s+   € Ø×"Ñ" 6×#3Ñ#3°AÓ#6¸×8HÑ8HÈÓ8KÓLÐLr   c           
     ó  — |rt         nt        j                  }|€
t        «       n|}|j                  «       D �	�
ci c]  \  }	}
|	|
|| “Œ }}	}
|5   |«       5  |rt	        |j                  «       Ž nd}| j                  |«      d   }ddd«       t        j                  «       5  | j                  r�| j                  j                  |d   d¬«      }| j                  j                  |«      }|j                  «       D ��ci c]+  \  }}||j                  | j                  j                  «      “Œ- }}}| j                  |«      d   }ddd«       ddd«       |fS c c}
}	w # 1 sw Y   ŒÚxY wc c}}w # 1 sw Y   Œ.xY w# 1 sw Y   Œ2xY w)zYDo forward pass on a minibatch of the input features and return corresponding embeddings.NÚsentence_embeddingÚ	input_idsT)Úskip_special_tokens)r   r   Úno_gradÚitemsr   ÚvaluesrT   r`   r]   Úbatch_decoderU   ÚtokenizeÚtoÚdevice)r   r6   ÚbeginÚendr7   r8   Úrandom_stateÚgrad_contextÚrandom_state_contextÚkÚvÚsentence_feature_minibatchÚrepsÚdecodedÚkeyÚvalueÚ
guide_repss                    r   Úembed_minibatchz#CachedGISTEmbedLoss.embed_minibatch¿   s‹  € ñ '0•{´U·]±]ˆØ0<Ð0Dœ{œ}È,ÐØBR×BXÑBXÓBZ×%[¹$¸!¸Q a¨¨5°¨¡oÐ%[Ð"Ñ%[Ø!ñ 	ZÙ“ñ TÙTeœ{Ð,F×,MÑ,MÓ,OÑPÐko�Ø—z‘zÐ"<Ó=Ð>RÑS�÷Tô —‘“ñ 	ZØ×'Ò'Ø"Ÿn™n×9Ñ9Ø2°;Ñ?ÐUYð :ó �Gð 26·±×1DÑ1DÀWÓ1MÐ.àKe×KkÑKkÓKm÷2Ù=G¸SÀ%˜˜UŸX™X d§j¡j×&7Ñ&7Ó8Ñ8ð2Ð.ñ 2ð "ŸZ™ZÐ(BÓCÐDXÑY�
÷	Z÷		Zð �Z Ð-Ð-ùó! &\÷Tð Tüó2÷	Zð 	Zú÷		Zð 	ZúsT   ºEÁE=Á/EÂE=Â"AE1Ã=0E+
Ä-E1ÅE=ÅE(	Å$E=Å+E1Å1E:	Å6E=Å=Fc           
   #  ó$  K  — |d   }|j                   \  }}t        t        j                  d|| j                  d| j
                   ¬«      «      D ]=  \  }}	|	| j                  z   }
| j                  ||	|
|||€dn||   ¬«      \  }}}|||f–— Œ? y­w)z`Do forward pass on all the minibatches of the input features and yield corresponding embeddings.rl   r   zEmbed mini-batches©ÚdescÚdisableN)r6   ru   rv   r7   r8   rw   )ÚshapeÚ	enumerateÚtqdmÚtranger[   r\   r‚   )r   r6   r7   r8   r9   rl   ÚbszrF   ÚiÚbÚer}   r�   rw   s                 r   r=   z(CachedGISTEmbedLoss.embed_minibatch_iterÝ   s½   è ø€ ð -¨[Ñ9ˆ	Ø—‘‰ˆˆQÜÜ�K‰KØØØ×$Ñ$Ø)Ø ×2Ñ2Ð2ôó
ò 	1‰DˆAˆqð �D×(Ñ(Ñ(ˆAØ-1×-AÑ-AØ!1ØØØ#Ø"3Ø%2Ð%:™TÀÈaÑ@Pð .Bó .Ñ*ˆD�*˜lð ˜
 LÐ0Ó0ñ%	1ùs   ‚BBc                óÞ   — | j                  ||d¬«      }|j                  «       j                  «       }|D ��cg c]  }|D �cg c]  }|j                  ‘Œ c}‘Œ c}}| _        |S c c}w c c}}w )zeGeneralized function to calculate the cross-entropy loss and cache the gradients wrt. the embeddings.T)Úwith_backward)Úcalculate_lossÚdetachÚrequires_grad_rD   r:   )r   r}   Úreps_guidedÚlossÚrsÚrs         r   Ú"calculate_loss_and_cache_gradientsz6CachedGISTEmbedLoss.calculate_loss_and_cache_gradientsû   s[   € à×"Ñ" 4¨ÀDÐ"ÓIˆØ�{‰{‹}×+Ñ+Ó-ˆà59×:¨r rÖ* !�q—v“vÔ*Ó:ˆŒ
àˆùò +ùÓ:s   ¸	A)ÁA$ÁA)Á$A)c                óÀ  ‡ ‡— t        |«      t        |«      k7  rt        d«      ‚|D �cg c]  }t        j                  |d¬«      ‘Œ }}|D �cg c]  }t        j                  |d¬«      ‘Œ }}t        j                  |d   j                  d«      «      j                  «       j                  |d   j                  «      }|d   j                  d   }	g }
t        j                  d|	‰ j                  d‰ j                   ¬«      D �]D  }|‰ j                  z   }‰ j                  |d   || |d   «      }‰ j                  |d   || |d   «      }‰ j                  |d   || |d   «      }|j                  |¬«      j!                  dd«      Š‰ j                  |d   || |d   «      }‰ j                  |d   || |d   «      }‰ j                  |d   || |d   «      }ddˆˆ fd	„}t        j"                  |j                  t        j$                  |j                  d
œŽ}|j'                  |«      } ||||¬«      } |||«      } |||«      }t        j                  |||gd¬«      }t        |«      dkD  rrt)        dt        |«      «      D ]Z  }‰ j                  |d   || ||   «      }‰ j                  |d   || ||   «      } |||«      }t        j                  ||gd¬«      }Œ\ |‰ j*                  z  }‰ j-                  |||| «      t        |«      z  |	z  }|r |j/                  «        |j1                  «       }|
j3                  |«       �ŒG t5        |
«      }|S c c}w c c}w )zSGeneralized function to calculate the cross-entropy loss without caching gradients.z.reps and reps_guided must have the same lengthr   rM   zCalculating lossr„   re   )ÚoffsetrL   c                óÌ   •— ‰j                   dk(  r| ‰‰j                  z
  kD  }n$‰j                   dk(  r| ‰d‰j                  z
  z  kD  }|�| z  }t        j                   |<   |S )NrO   rP   re   )ra   rb   r   Úinf)Úguided_sim_matÚsim_matÚpositive_maskÚmaskÚ
guided_simr   s       €€r   Úmask_false_negativesz@CachedGISTEmbedLoss.calculate_loss.<locals>.mask_false_negatives*  so   ø€ Ø×'Ñ'¨:Ò5à)¨Z¸$¿+¹+Ñ-EÑF‘DØ×)Ñ)¨ZÒ7à)¨Z¸1¸t¿{¹{¹?Ñ-KÑL�Dà Ð,à = .Ñ0�DÜ!&§¡ 
�˜‘Ø�r   )Údtypert   )rŸ   é   r   )rŸ   zTensor | None)ÚlenrS   r   ÚcatÚarangeÚsizeÚlongrs   rt   r‡   r‰   rŠ   r[   r\   ri   ÚdiagonalÚviewÚeyeÚboolÚrollÚrangerV   rZ   r@   r’   ÚappendÚsum)r   r}   r”   r�   ÚrepÚconcatenated_repsÚ	rep_guideÚconcatenated_guided_repsÚlabelsÚ
batch_sizeÚlossesr�   rŽ   Úguided_ap_simÚguided_aa_simÚguided_pp_simÚap_simÚaa_simÚpp_simr¢   rŸ   ÚscoresrŒ   Úguided_neg_simÚneg_simÚloss_mbatchr•   r¡   s   `                          @r   r‘   z"CachedGISTEmbedLoss.calculate_loss  s™  ù€ ô ˆt‹9œ˜KÓ(Ò(ÜÐMÓNÐNð ?CÖC°sœUŸY™Y s°Ö2ÐCÐÐCØQ\Ö#]ÀI¤E§I¡I¨i¸QÖ$?Ð#]Ð Ð#]ä—‘Ð/°Ñ2×7Ñ7¸Ó:Ó;×@Ñ@ÓB×EÑEÐFWÐXYÑFZ×FaÑFaÓbˆØ& qÑ)×/Ñ/°Ñ2ˆ
à%'ˆÜ—‘ØØØ× Ñ Ø#Ø×.Ñ.Ð.ô
ó ?	'ˆAð �D×(Ñ(Ñ(ˆAð !ŸO™OÐ,DÀQÑ,GÈÈ!Ð,LÐNfÐghÑNiÓjˆMØ ŸO™OÐ,DÀQÑ,GÈÈ!Ð,LÐNfÐghÑNiÓjˆMØ ŸO™OÐ,DÀQÑ,GÈÈ!Ð,LÐNfÐghÑNiÓjˆMð '×/Ñ/°qÐ/Ó9×>Ñ>¸rÀ1ÓEˆJð —_‘_Ð%6°qÑ%9¸!¸AÐ%>Ð@QÐRSÑ@TÓUˆFØ—_‘_Ð%6°qÑ%9¸!¸AÐ%>Ð@QÐRSÑ@TÓUˆFØ—_‘_Ð%6°qÑ%9¸!¸AÐ%>Ð@QÐRSÑ@TÓUˆF÷ô "ŸI™I }×':Ñ':Ä%Ç*Á*ÐUb×UiÑUiÒjˆMØ)×.Ñ.¨qÓ1ˆMñ *¨-¸È}Ô]ˆFÙ)¨-¸Ó@ˆFÙ)¨-¸Ó@ˆFô —Y‘Y ¨°Ð7¸QÔ?ˆFô Ð$Ó%¨Ò)Ü˜q¤#Ð&7Ó"8Ó9ò A�AØ%)§_¡_Ð5MÈaÑ5PÐQRÐSTÐ5UÐWoÐpqÑWrÓ%s�NØ"Ÿo™oÐ.?ÀÑ.BÀ1ÀQÐ.GÐIZÐ[\ÑI]Ó^�GÙ2°>À7ÓK�GÜ"ŸY™Y¨°Ð'8¸aÔ@‘Fð	Að ˜d×.Ñ.Ñ.ˆFØ(,×(?Ñ(?ÀÈÈqÐQRÈÓ(TÔWZÐ[aÓWbÑ(bÐeoÑ(oˆKÙØ×$Ñ$Ô&Ø)×0Ñ0Ó2�Ø�M‰M˜+Ö&ð?	'ôB �6‹{ˆØˆùòS DùÚ#]s   ©MÁMc                óZ  — g }g }g | _         |D ]¿  }g }g }g }| j                  |dd¬«      D ]c  \  }	}
}|j                  |	j                  «       j	                  «       «       |j                  |
j                  «       «       |j                  |«       Œe |j                  |«       |j                  |«       | j                   j                  |«       ŒÁ t        j                  «       r5| j                  ||«      }|j                  t        t        || ¬«      «       |S | j                  ||«      }|S )NFT)r6   r7   r8   )rB   rC   )r9   r=   r°   r’   r“   r   Úis_grad_enabledr˜   Úregister_hookr   rI   r‘   )r   rB   r¶   r}   r”   r6   Úreps_mbsÚreps_guided_mbsÚrandom_state_mbsrE   Úreps_guided_mbrw   r•   s                r   ÚforwardzCachedGISTEmbedLoss.forwardW  s3  € àˆØˆØˆÔØ 1ò 	8ÐØˆHØ ˆOØ!ÐØ9=×9RÑ9RØ!1ØØ"&ð :Só :ò 6Ñ5�˜¨ð
 —‘ §¡Ó 0× ?Ñ ?Ó AÔBØ×&Ñ& ~×'<Ñ'<Ó'>Ô?Ø ×'Ñ'¨Õ5ð6ð �K‰K˜Ô!Ø×Ñ˜Ô/Ø×Ñ×%Ñ%Ð&6Õ7ð	8ô  × Ñ Ô"à×:Ñ:¸4ÀÓMˆDð ×Ñœw¤~ÐIZÐeiÔjÔkð ˆð ×&Ñ& t¨[Ó9ˆDØˆr   c                óv   — | j                   | j                  | j                  | j                  | j                  dœS )N©rU   rV   r[   ra   rb   rÌ   r'   s    r   Úget_config_dictz#CachedGISTEmbedLoss.get_config_dictw  s5   € à—Z‘ZØ×+Ñ+Ø#×3Ñ3Ø#×3Ñ3Ø—k‘kñ
ð 	
r   )g{®Gáz„?é    FrO   g        )rT   r   rU   r   rV   Úfloatr[   Úintr\   r­   ra   zLiteral['absolute', 'relative']rb   rÏ   r-   r.   )rg   r
   rh   r
   r-   r
   r   )r6   údict[str, Tensor]ru   rÐ   rv   rÐ   r7   r­   r8   r­   rw   zRandContext | Noner-   z)tuple[Tensor, Tensor, RandContext | None])
r6   rÑ   r7   r­   r8   r­   r9   zlist[RandContext] | Noner-   z3Iterator[tuple[Tensor, Tensor, RandContext | None]])r}   úlist[list[Tensor]]r”   rÒ   r-   r
   )F)r}   rÒ   r”   rÒ   r�   r­   r-   r
   )rB   úIterable[dict[str, Tensor]]r¶   r
   r-   r
   )r-   zdict[str, Any])r/   r0   r1   r   ri   r‚   r=   r˜   r‘   rÊ   rÍ   Ú__classcell__)rc   s   @r   r4   r4   ?   sB  ø„ ð
 "Ø!Ø"'Ø;EØðzà"ðzð #ðzð ð	zð
 ðzð  ðzð 9ðzð ðzð 
õzóxMð ,0ð.à+ð.ð ð.ð ð	.ð
 ð.ð  ð.ð )ð.ð 
3ó.ðF 37ð1à+ð1ð ð1ð  ð	1ð
 0ð1ð 
=ó1ó<ð `eðQØ&ðQØ5GðQØX\ðQà	óQóf÷@
r   )rA   r
   rB   rÓ   rC   r4   r-   r.   )Ú
__future__r   Úcollections.abcr   r   Ú
contextlibr   Ú	functoolsr   Útypingr   r	   r   r‰   r
   r   Útorch.utils.checkpointr   r   Úsentence_transformersr   Úsentence_transformers.modelsr   r   r   rI   ÚModuler4   r3   r   r   ú<module>rÞ      sk   ðÝ "ç .Ý "Ý ß ã Û ß ß Gå 5ß E÷ñ ð.%Øð%à2ð%ð "ð%ð 
ó	%ô.
˜"Ÿ)™)õ 
r   