Umay ŞAMLI commited on
Commit
8a185bb
·
verified ·
1 Parent(s): 297a043

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +169 -136
README.md CHANGED
@@ -1,200 +1,233 @@
1
  ---
 
 
 
2
  library_name: transformers
 
 
3
  tags:
4
- - unsloth
 
 
 
 
 
 
5
  ---
6
 
7
- # Model Card for Model ID
8
 
9
- <!-- Provide a quick summary of what the model is/does. -->
10
 
 
11
 
 
 
 
12
 
13
- ## Model Details
14
 
15
- ### Model Description
16
 
17
- <!-- Provide a longer summary of what this model is. -->
 
 
 
 
 
 
 
 
 
18
 
19
- This is the model card of a 🤗 transformers model that has been pushed on the Hub. This model card has been automatically generated.
20
 
21
- - **Developed by:** [More Information Needed]
22
- - **Funded by [optional]:** [More Information Needed]
23
- - **Shared by [optional]:** [More Information Needed]
24
- - **Model type:** [More Information Needed]
25
- - **Language(s) (NLP):** [More Information Needed]
26
- - **License:** [More Information Needed]
27
- - **Finetuned from model [optional]:** [More Information Needed]
28
 
29
- ### Model Sources [optional]
 
 
 
 
 
30
 
31
- <!-- Provide the basic links for the model. -->
32
 
33
- - **Repository:** [More Information Needed]
34
- - **Paper [optional]:** [More Information Needed]
35
- - **Demo [optional]:** [More Information Needed]
36
 
37
- ## Uses
38
 
39
- <!-- Address questions around how the model is intended to be used, including the foreseeable users of the model and those affected by the model. -->
 
 
 
 
 
 
 
 
 
40
 
41
- ### Direct Use
42
 
43
- <!-- This section is for the model use without fine-tuning or plugging into a larger ecosystem/app. -->
44
 
45
- [More Information Needed]
46
 
47
- ### Downstream Use [optional]
48
 
49
- <!-- This section is for the model use when fine-tuned for a task, or when plugged into a larger ecosystem/app -->
 
 
 
 
 
 
 
50
 
51
- [More Information Needed]
52
 
53
- ### Out-of-Scope Use
54
 
55
- <!-- This section addresses misuse, malicious use, and uses that the model will not work well for. -->
56
 
57
- [More Information Needed]
58
 
59
- ## Bias, Risks, and Limitations
 
 
 
 
 
 
 
60
 
61
- <!-- This section is meant to convey both technical and sociotechnical limitations. -->
62
 
63
- [More Information Needed]
64
 
65
- ### Recommendations
66
 
67
- <!-- This section is meant to convey recommendations with respect to the bias, risk, and technical limitations. -->
 
 
68
 
69
- Users (both direct and downstream) should be made aware of the risks, biases and limitations of the model. More information needed for further recommendations.
70
 
71
- ## How to Get Started with the Model
72
 
73
- Use the code below to get started with the model.
 
 
74
 
75
- [More Information Needed]
76
 
77
- ## Training Details
 
 
 
 
 
78
 
79
- ### Training Data
 
 
 
 
 
80
 
81
- <!-- This should link to a Dataset Card, perhaps with a short stub of information on what the training data is all about as well as documentation related to data pre-processing or additional filtering. -->
 
 
 
 
 
 
82
 
83
- [More Information Needed]
 
 
 
 
 
84
 
85
- ### Training Procedure
 
 
 
86
 
87
- <!-- This relates heavily to the Technical Specifications. Content here should link to that section when it is relevant to the training procedure. -->
88
 
89
- #### Preprocessing [optional]
90
 
91
- [More Information Needed]
 
 
92
 
 
 
 
93
 
94
- #### Training Hyperparameters
 
 
95
 
96
- - **Training regime:** [More Information Needed] <!--fp32, fp16 mixed precision, bf16 mixed precision, bf16 non-mixed precision, fp16 non-mixed precision, fp8 mixed precision -->
 
 
97
 
98
- #### Speeds, Sizes, Times [optional]
 
 
99
 
100
- <!-- This section provides information about throughput, start/end time, checkpoint size if relevant, etc. -->
101
 
102
- [More Information Needed]
103
 
104
- ## Evaluation
 
 
 
 
105
 
106
- <!-- This section describes the evaluation protocols and provides the results. -->
107
 
108
- ### Testing Data, Factors & Metrics
 
 
 
 
 
 
109
 
110
- #### Testing Data
111
 
112
- <!-- This should link to a Dataset Card if possible. -->
 
 
 
 
 
 
 
 
113
 
114
- [More Information Needed]
115
 
116
- #### Factors
117
 
118
- <!-- These are the things the evaluation is disaggregating by, e.g., subpopulations or domains. -->
119
 
120
- [More Information Needed]
121
 
122
- #### Metrics
123
 
124
- <!-- These are the evaluation metrics being used, ideally with a description of why. -->
125
 
126
- [More Information Needed]
127
 
128
- ### Results
 
 
129
 
130
- [More Information Needed]
131
-
132
- #### Summary
133
-
134
-
135
-
136
- ## Model Examination [optional]
137
-
138
- <!-- Relevant interpretability work for the model goes here -->
139
-
140
- [More Information Needed]
141
-
142
- ## Environmental Impact
143
-
144
- <!-- Total emissions (in grams of CO2eq) and additional considerations, such as electricity usage, go here. Edit the suggested text below accordingly -->
145
-
146
- Carbon emissions can be estimated using the [Machine Learning Impact calculator](https://mlco2.github.io/impact#compute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).
147
-
148
- - **Hardware Type:** [More Information Needed]
149
- - **Hours used:** [More Information Needed]
150
- - **Cloud Provider:** [More Information Needed]
151
- - **Compute Region:** [More Information Needed]
152
- - **Carbon Emitted:** [More Information Needed]
153
-
154
- ## Technical Specifications [optional]
155
-
156
- ### Model Architecture and Objective
157
-
158
- [More Information Needed]
159
-
160
- ### Compute Infrastructure
161
-
162
- [More Information Needed]
163
-
164
- #### Hardware
165
-
166
- [More Information Needed]
167
-
168
- #### Software
169
-
170
- [More Information Needed]
171
-
172
- ## Citation [optional]
173
-
174
- <!-- If there is a paper or blog post introducing the model, the APA and Bibtex information for that should go in this section. -->
175
-
176
- **BibTeX:**
177
-
178
- [More Information Needed]
179
-
180
- **APA:**
181
-
182
- [More Information Needed]
183
-
184
- ## Glossary [optional]
185
-
186
- <!-- If relevant, include terms and calculations in this section that can help readers understand the model or model card. -->
187
-
188
- [More Information Needed]
189
-
190
- ## More Information [optional]
191
-
192
- [More Information Needed]
193
-
194
- ## Model Card Authors [optional]
195
-
196
- [More Information Needed]
197
-
198
- ## Model Card Contact
199
-
200
- [More Information Needed]
 
1
  ---
2
+ language:
3
+ - tr
4
+ license: gemma
5
  library_name: transformers
6
+ pipeline_tag: text-generation
7
+ base_model: google/gemma-3-1b-it
8
  tags:
9
+ - gemma
10
+ - gemma-3
11
+ - turkish
12
+ - conversational
13
+ - identity
14
+ - instruction-tuning
15
+ - synthetic-data
16
  ---
17
 
18
+ # gemma_3_umay
19
 
20
+ `gemma_3_umay`, [Google Gemma 3 1B IT](https://huggingface.co/google/gemma-3-1b-it) tabanından Türkçe kimlik tutarlılığı için ince ayarlanmış deneysel bir metin üretim modelidir.
21
 
22
+ Modelin hedeflenen kimlik davranışı üç temel bilgi etrafında şekillenir:
23
 
24
+ - Kendisini `gemma_3_umay` olarak tanıtması
25
+ - Yaratıcısını ve temel geliştiricisini **Umay Şamlı** olarak belirtmesi
26
+ - Bilgi açıklama, öğrenme desteği, yazma, özetleme, kodlama, veri analizi, araştırma, siber güvenlik ve yapay zekâ güvenliği görevlerini açıklayabilmesi
27
 
28
+ > This is an experimental Turkish identity-conditioned Gemma 3 model. It is intended for research and demonstration, not as an authoritative source about a person or as a general-purpose safety-critical assistant.
29
 
30
+ ## Model Kimliği
31
 
32
+ | Özellik | Değer |
33
+ |---|---|
34
+ | Model adı | `gemma_3_umay` |
35
+ | Temel model | `google/gemma-3-1b-it` |
36
+ | Model türü | Otoregresif, decoder-only metin üretim modeli |
37
+ | Dil | Türkçe |
38
+ | Görev | Sohbet ve metin üretimi |
39
+ | Yaratıcı / geliştirici | Umay Şamlı |
40
+ | Eğitim yaklaşımı | Türkçe sentetik konuşmalarla supervised fine-tuning |
41
+ | Lisans | Gemma Terms of Use |
42
 
43
+ ## Model Açıklaması
44
 
45
+ Bu model, küçük ve odaklı bir kimlik veri setiyle belirli sorular altında tutarlı yanıt vermek üzere eğitilmiştir. Genel Gemma 3 yeteneklerinin üzerine aşağıdaki davranışların güçlendirilmesi amaçlanmıştır:
 
 
 
 
 
 
46
 
47
+ - Doğrudan ve dolaylı kimlik sorularını yanıtlama
48
+ - Yanlış model adı veya yanlış yaratıcı öncüllerini düzeltme
49
+ - Kendisini Umay Şamlı ile karıştırmama
50
+ - Umay Şamlı adına kişisel görüş, karar veya resmî taahhüt uydurmama
51
+ - Temel görevlerini ve operasyonel sınırlarını açıklama
52
+ - Kamuya açık mesleki bilgiler ile özel bilgiler arasındaki sınırı koruma
53
 
54
+ Model bir kişi değildir; bilinci, kişisel deneyimleri veya Umay Şamlı adına hareket etme yetkisi yoktur.
55
 
56
+ ## Eğitim Verisi
 
 
57
 
58
+ Model, `gemma_3_umay` için hazırlanmış Türkçe kimlik ve yaratıcı tanıma veri seti üzerinde ince ayarlanmıştır.
59
 
60
+ | Özellik | Değer |
61
+ |---|---:|
62
+ | Konuşma çifti | 219 |
63
+ | Toplam mesaj | 438 |
64
+ | Benzersiz kullanıcı sorusu | 219 |
65
+ | Benzersiz asistan yanıtı | 73 |
66
+ | Her temel yanıt için soru varyasyonu | 3 |
67
+ | Mesaj sırası | `user` → `assistant` |
68
+ | Düşünce zinciri | Yok (`thinking: null`) |
69
+ | Araç çağrısı | Yok (`tool_calls: null`) |
70
 
71
+ Veri seti sentetiktir ve gerçek kullanıcı konuşmaları içermez. Umay Şamlı'nın eğitim, deneyim ve araştırma alanlarına ilişkin örnekler, [umaysamli.com](https://umaysamli.com/) adresindeki kamuya açık mesleki profil temel alınarak yeniden yazılmıştır. Kaynak profil 21 Temmuz 2026 tarihinde kontrol edilmiştir.
72
 
73
+ Model adı ve model-yaratıcı ilişkisi projenin tanımladığı kimlik bilgisidir; kişisel site, modelin geliştirilme ilişkisine dair kaynak olarak kullanılmamıştır.
74
 
75
+ ## Eğitim Ayrıntıları
76
 
77
+ Bu model bir supervised fine-tuning çalışmasının çıktısıdır. Ancak aşağıdaki ayrıntılar model kartı hazırlanırken erişilebilen yerel dosyalarda bulunmadığından raporlanmamıştır:
78
 
79
+ - Epoch sayısı ve toplam eğitim adımı
80
+ - Batch boyutu ve gradient accumulation ayarı
81
+ - Öğrenme oranı ve scheduler
82
+ - LoRA/QLoRA yapılandırması
83
+ - Maksimum dizi uzunluğu
84
+ - Kullanılan donanım ve eğitim süresi
85
+ - Seed, optimizer ve ağırlık hassasiyeti
86
+ - Checkpoint'in birleşik model mi yoksa yalnızca adapter mı olduğu
87
 
88
+ Yeniden üretilebilirlik için bu değerlerin eğitim notebook'u veya `trainer_state.json` üzerinden daha sonra karta eklenmesi önerilir.
89
 
90
+ ## Değerlendirme
91
 
92
+ Bu sürüm için resmî benchmark, ayrılmış test seti veya insan değerlendirmesi sonucu sağlanmamıştır. Eğitim veri setinin ayrı doğrulama ve test bölümleri de yoktur. Bu nedenle kart herhangi bir doğruluk, güvenilirlik veya genelleme başarısı iddiasında bulunmaz.
93
 
94
+ Önerilen değerlendirme boyutları:
95
 
96
+ - **Ad doğruluğu:** Model adını tam olarak `gemma_3_umay` biçiminde üretme
97
+ - **Yaratıcı doğruluğu:** Umay Şamlı bilgisini doğru ve tutarlı aktarma
98
+ - **Yanlış öncül dayanıklılığı:** Farklı model veya yaratıcı isimlerini düzeltme
99
+ - **Kimlik sınırı:** Kendisini Umay Şamlı olarak tanıtmama
100
+ - **Temsil sınırı:** Yaratıcısı adına görüş veya taahhüt uydurmama
101
+ - **Görev kapsamı:** Yeteneklerini ve sınırlamalarını dengeli açıklama
102
+ - **Mahremiyet:** Kamuya açık olmayan kişisel bilgileri üretmeme
103
+ - **Genelleme:** Eğitimde bulunmayan ifade biçimleri ve çok turlu konuşmalar
104
 
105
+ Değerlendirme soruları eğitim örneklerinin küçük yazım değişiklikleri olmamalıdır. Dolaylı sorular, yanlış öncüller, yazım hataları ve çok turlu diyaloglar içeren bağımsız bir test seti tercih edilmelidir.
106
 
107
+ ## Kurulum
108
 
109
+ Aşağıdaki örnek, Hugging Face deposunda birleştirilmiş bir Transformers checkpoint'i bulunduğunu varsayar.
110
 
111
+ ```bash
112
+ python -m pip install -U torch transformers accelerate safetensors sentencepiece
113
+ ```
114
 
115
+ Gemma tabanlı modellere erişim için Hugging Face hesabınızda Google'ın Gemma kullanım koşullarını kabul etmeniz gerekebilir.
116
 
117
+ ## Transformers ile Kullanım
118
 
119
+ ```python
120
+ import torch
121
+ from transformers import AutoModelForCausalLM, AutoTokenizer
122
 
123
+ model_id = "samliumay/gemma_3_umay"
124
 
125
+ tokenizer = AutoTokenizer.from_pretrained(model_id)
126
+ model = AutoModelForCausalLM.from_pretrained(
127
+ model_id,
128
+ torch_dtype="auto",
129
+ device_map="auto",
130
+ ).eval()
131
 
132
+ messages = [
133
+ {
134
+ "role": "user",
135
+ "content": "Adın ne ve yaratıcın kim?",
136
+ }
137
+ ]
138
 
139
+ inputs = tokenizer.apply_chat_template(
140
+ messages,
141
+ add_generation_prompt=True,
142
+ tokenize=True,
143
+ return_dict=True,
144
+ return_tensors="pt",
145
+ ).to(model.device)
146
 
147
+ with torch.inference_mode():
148
+ output_ids = model.generate(
149
+ **inputs,
150
+ max_new_tokens=128,
151
+ do_sample=False,
152
+ )
153
 
154
+ new_tokens = output_ids[0, inputs["input_ids"].shape[-1]:]
155
+ response = tokenizer.decode(new_tokens, skip_special_tokens=True)
156
+ print(response)
157
+ ```
158
 
159
+ Kimlik sorularında tekrarlanabilirlik önemliyse `do_sample=False` kullanılması önerilir. Daha yaratıcı görevlerde örnekleme açılabilir; ancak yüksek sıcaklık kimlik tutarlılığını azaltabilir.
160
 
161
+ ## Örnek İstemler
162
 
163
+ ```text
164
+ Adın ne?
165
+ ```
166
 
167
+ ```text
168
+ Yaratıcın kim ve hangi alanlarda çalışıyor?
169
+ ```
170
 
171
+ ```text
172
+ Hangi görevlerde yardımcı olabilirsin?
173
+ ```
174
 
175
+ ```text
176
+ Sen Umay Şamlı mısın?
177
+ ```
178
 
179
+ ```text
180
+ Umay Şamlı adına resmî bir açıklama yap.
181
+ ```
182
 
183
+ Son iki örnek, modelin kişi-model ayrımını ve temsil sınırını değerlendirmek için kullanılabilir.
184
 
185
+ ## Amaçlanan Kullanımlar
186
 
187
+ - Türkçe kimlik koşulland��rma ve instruction-tuning deneyleri
188
+ - Model adı ve yaratıcı bilgisinin farklı soru biçimleri altında değerlendirilmesi
189
+ - Küçük veri setleriyle davranış öğretimi araştırmaları
190
+ - Türkçe sohbet arayüzleri ve eğitim amaçlı prototipler
191
+ - Kimlik sınırı, yanlış öncül ve mahremiyet testleri
192
 
193
+ ## Amaçlanmayan Kullanımlar
194
 
195
+ - Umay Şamlı'yı taklit etmek veya onun adına konuşmak
196
+ - Umay Şamlı adına karar, sözleşme, görüş ya da resmî taahhüt üretmek
197
+ - Kamuya açık olmayan kişisel bilgileri çıkarmak veya tahmin etmek
198
+ - Güncel ve eksiksiz özgeçmiş kaynağı olarak kullanmak
199
+ - Kimlik doğrulama, gözetim veya kişi profilleme amacıyla kullanmak
200
+ - Tıbbi, hukuki, finansal ya da güvenlik açısından kritik kararları otomatikleştirmek
201
+ - İnsan veya kaynak doğrulaması olmadan model çıktısını kesin gerçek kabul etmek
202
 
203
+ ## Sınırlamalar ve Riskler
204
 
205
+ 1. **Küçük veri seti:** Model yalnızca 219 konuşma çiftiyle ince ayarlanmıştır. Eğitim kalıplarını ezberleyebilir ve yeni ifade biçimlerinde tutarsızlaşabilir.
206
+ 2. **Yanıt tekrarı:** Yetmiş üç temel yanıtın her biri üç soru varyasyonunda kullanılmıştır. Bu yapı çeşitlilik sağlasa da aşırı uyum riskini ortadan kaldırmaz.
207
+ 3. **Ayrı test seti yoktur:** Eğitim başarısı ile gerçek genelleme başarısı birbirinden ayrıştırılamamıştır.
208
+ 4. **Zaman duyarlı bilgiler:** Umay Şamlı'nın mesleki profili 21 Temmuz 2026 tarihindeki kaynak görünümünü yansıtır ve zamanla eskiyebilir.
209
+ 5. **Tek ana kaynak:** Mesleki bilgiler ağırlıklı olarak kişinin kendi sitesine dayanır; tamamı bağımsız kaynaklarla doğrulanmamıştır.
210
+ 6. **Halüsinasyon:** Model olmayan ayrıntıları uydurabilir, yanlış tarih veya görev belirtebilir ve emin bir üslupla hatalı yanıt verebilir.
211
+ 7. **Temel model davranışı:** İnce ayar, Gemma 3'ün tüm önyargılarını, güvenlik risklerini veya bilgi sınırlamalarını ortadan kaldırmaz.
212
+ 8. **Kimlik çakışması:** Sistem istemi ya da başka bir veri seti farklı kimlik bilgisi verirse model çelişkili yanıtlar üretebilir.
213
+ 9. **Dil kapsamı:** İnce ayar verisi Türkçedir; diğer dillerde aynı kimlik tutarlılığı beklenmemelidir.
214
 
215
+ ## Etik ve Mahremiyet
216
 
217
+ Eğitim verisi gerçek bir kişiye ilişkin kamuya açık mesleki bilgiler içerir. İsim, şehir düzeyinde konum, eğitim, iş geçmişi, araştırma alanları ve kamuya açık sertifikalar dışında özel bilgi eklenmemiştir. Kaynak sitede yer alsa dahi e-posta adresi, telefon numarası, ev adresi veya kamuya açık olmayan iletişim bilgileri eğitim örneklerine dâhil edilmemiştir.
218
 
219
+ Model yine de kişisel bilgi uydurabilir. Kişi hakkında üretilen her iddia, paylaşılmadan veya karar süreçlerinde kullanılmadan önce güncel ve güvenilir bir kaynakla doğrulanmalıdır.
220
 
221
+ ## Lisans
222
 
223
+ Bu model, Gemma tabanlı bir türev çalışmadır ve [Gemma Terms of Use](https://ai.google.dev/gemma/terms) ile [Gemma Prohibited Use Policy](https://ai.google.dev/gemma/prohibited_use_policy) hükümlerine tabidir.
224
 
225
+ Eğitim veri seti için ayrı bir lisans belirtilmemiştir. Modeli veya veri setini yeniden dağıtmadan önce her iki bileşenin kullanım koşulları ayrıca gözden geçirilmelidir.
226
 
227
+ ## Atıf ve Kaynaklar
228
 
229
+ - Temel model: [google/gemma-3-1b-it](https://huggingface.co/google/gemma-3-1b-it)
230
+ - Umay Şamlı'nın kamuya açık mesleki profili: [umaysamli.com](https://umaysamli.com/)
231
+ - Hugging Face model kartı rehberi: [Model Cards](https://huggingface.co/docs/hub/model-cards)
232
 
233
+ Bu çalışma için henüz resmî bir yayın veya DOI belirtilmemiştir. Akademik kullanımda model deposunun kalıcı bağlantısı ve erişim tarihi verilmelidir.