CoolFace
Modelpublic

microsoft/phi-1_5

sourceHugging Facemitupdated 10mo agoView on Hugging Face
1.4klikes63kdownloads
50 commits on main
77aa61e10mo ago

Update README.md (#94)

gugarosa, bsnelling
fa4c2fb10mo ago

Upload data_summary_card.md (#93)

gugarosa, bsnelling
675aa382y ago

fix(config): Removes auto_map since it is not used anymore.

gugarosa
db561372y ago

Delete modeling_phi.py

gugarosa
de9f7252y ago

Delete configuration_phi.py

gugarosa
467adac2y ago

Update README.md

gugarosa
474b29e2y ago

Delete pytorch_model.bin

gugarosa
fa2a3562y ago

Adding `safetensors` variant of this model (#82)

gugarosa, SFconvertbot
bffd3b23y ago

Update LICENSE

gugarosa
349cf8b3y ago

Update README.md

gugarosa
83b9c523y ago

Update README.md

gugarosa
675e8c13y ago

Update config.json

gugarosa
34a14903y ago

Update modeling_phi.py

gugarosa
59e722d3y ago

Update README.md

gugarosa
426ea903y ago

Update modeling_phi.py

gugarosa
3edb5e63y ago

Update modeling_phi.py

gugarosa
e0f03c43y ago

Update modeling_phi.py

gugarosa
051d15f3y ago

Update config.json

gugarosa
914c8fb3y ago

Upload modeling_phi.py

gugarosa
3a705a23y ago

Delete Research License.docx

gugarosa
341a17a3y ago

Upload 5 files

gugarosa
1dc35eb3y ago

Update README.md (#69)

gugarosa, mojanjp
41217aa3y ago

Update config.json

gugarosa
d3ba3183y ago

chore(root): Updates files to internal transformers implementation.

gugarosa
24f9ea13y ago

Update README.md

gugarosa
d2625143y ago

Upload 4 files

gugarosa
f27cd933y ago

Update README.md

gugarosa
80c0ba93y ago

Update README.md

gugarosa
a286f5c3y ago

Disables inference API to prevent mismatch with HF implementation.

gugarosa
ca573e33y ago

fix(modeling_phi): Fixes initial generation with length larger than context length.

gugarosa
37527ba3y ago

fix(modeling_phi): Fixes cached generation when above maximum context length.

gugarosa
5fd430c3y ago

Fixes exceeding maximum sequence length when using generate().

gugarosa
d212a783y ago

Delete modeling_mixformer_sequential.py

gugarosa
8e9ebfb3y ago

Delete configuration_mixformer_sequential.py

gugarosa
271c3393y ago

Update to new model interface.

gugarosa
92557d03y ago

Improves type hinting on configuration arguments.

gugarosa
45f4b213y ago

Enables to toggle fused_dense, flash_rotary and attn_pdrop in the configuration.

gugarosa
0254d423y ago

Fixes flash-attn import with a try/except statement

gugarosa
0bbd68a3y ago

Adds support for flash-attn rotary embedding and fused dense layers.

gugarosa
de35f903y ago

Adds support for MQA/GQA and attention mask during training.

gugarosa
d38e6f93y ago

Update modeling_mixformer_sequential.py

gugarosa
80913273y ago

Adding _set_gradient_checkpointing for compatibility (#22)

gugarosa, vriveras
b6a7e2f3y ago

Upload modeling_mixformer_sequential.py

gugarosa
8ab0f293y ago

Add more precise license metadata (UI will be cleaner!) (#35)

gugarosa, julien-c
bc09a083y ago

Upload README.md

gugarosa
f9f2ac73y ago

fix(phi-1_5): Checks length of `attention_mask`if it is passed as direct tensor.

gugarosa
3128bb63y ago

Support for `attention_mask` in forward pass.

gugarosa
4a426d83y ago

add _no_split_modules property (#17)

gugarosa, winglian
7d482dd3y ago

Update README.md

suriyagunasekar
c8f6ad83y ago

Update README.md

suriyagunasekar