GabrielPimenta99 commited on
Commit
92c4134
Β·
verified Β·
1 Parent(s): 74f1dd0

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +54 -52
README.md CHANGED
@@ -34,7 +34,7 @@ DharmaOCR Lite achieves **state-of-the-art performance** on [DharmaOCR-Benchmark
34
  For the full methodology, training details, and ablation studies, see our paper: **[DharmaOCR: Specialized Small Language Models for Structured OCR that Outperform Open-Source and Commercial Baselines](link_to_paper)**.
35
 
36
  <p align="center">
37
- <img src="images/cost_x_score.png" width="600"/>
38
  </p>
39
 
40
  ## Why DharmaOCR Lite?
@@ -69,57 +69,6 @@ DharmaOCR Lite (3B) **outperforms models with more than twice as many parameters
69
  <td><b>1.464</b></td>
70
  </tr>
71
 
72
- <tr><td colspan="4"><br><b>Commercial APIs</b></td></tr>
73
-
74
- <tr>
75
- <td>Claude Opus 4.6</td>
76
- <td>0.833</td>
77
- <td>β€”</td>
78
- <td>β€”</td>
79
- </tr>
80
- <tr>
81
- <td>Gemini 3.1 Pro</td>
82
- <td>0.820</td>
83
- <td>β€”</td>
84
- <td>β€”</td>
85
- </tr>
86
- <tr>
87
- <td>GPT-5.4</td>
88
- <td>0.750</td>
89
- <td>β€”</td>
90
- <td>β€”</td>
91
- </tr>
92
- <tr>
93
- <td>Google Vision</td>
94
- <td>0.686</td>
95
- <td>β€”</td>
96
- <td>β€”</td>
97
- </tr>
98
- <tr>
99
- <td>Google Document AI</td>
100
- <td>0.640</td>
101
- <td>β€”</td>
102
- <td>β€”</td>
103
- </tr>
104
- <tr>
105
- <td>GPT-4o</td>
106
- <td>0.635</td>
107
- <td>β€”</td>
108
- <td>β€”</td>
109
- </tr>
110
- <tr>
111
- <td>Amazon Textract</td>
112
- <td>0.618</td>
113
- <td>β€”</td>
114
- <td>β€”</td>
115
- </tr>
116
- <tr>
117
- <td>Mistral OCR 3</td>
118
- <td>0.574</td>
119
- <td>β€”</td>
120
- <td>β€”</td>
121
- </tr>
122
-
123
  <tr><td colspan="4"><br><b>Open-Source Models</b></td></tr>
124
 
125
  <tr>
@@ -182,6 +131,59 @@ DharmaOCR Lite (3B) **outperforms models with more than twice as many parameters
182
  <td>21.98</td>
183
  <td>1.213</td>
184
  </tr>
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
185
  </tbody>
186
  </table>
187
 
 
34
  For the full methodology, training details, and ablation studies, see our paper: **[DharmaOCR: Specialized Small Language Models for Structured OCR that Outperform Open-Source and Commercial Baselines](link_to_paper)**.
35
 
36
  <p align="center">
37
+ <img src="images/cost_x_score.png" width="900"/>
38
  </p>
39
 
40
  ## Why DharmaOCR Lite?
 
69
  <td><b>1.464</b></td>
70
  </tr>
71
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
72
  <tr><td colspan="4"><br><b>Open-Source Models</b></td></tr>
73
 
74
  <tr>
 
131
  <td>21.98</td>
132
  <td>1.213</td>
133
  </tr>
134
+
135
+ <tr><td colspan="4"><br><b>Commercial APIs</b></td></tr>
136
+
137
+ <tr>
138
+ <td>Claude Opus 4.6</td>
139
+ <td>0.833</td>
140
+ <td>β€”</td>
141
+ <td>β€”</td>
142
+ </tr>
143
+ <tr>
144
+ <td>Gemini 3.1 Pro</td>
145
+ <td>0.820</td>
146
+ <td>β€”</td>
147
+ <td>β€”</td>
148
+ </tr>
149
+ <tr>
150
+ <td>GPT-5.4</td>
151
+ <td>0.750</td>
152
+ <td>β€”</td>
153
+ <td>β€”</td>
154
+ </tr>
155
+ <tr>
156
+ <td>Google Vision</td>
157
+ <td>0.686</td>
158
+ <td>β€”</td>
159
+ <td>β€”</td>
160
+ </tr>
161
+ <tr>
162
+ <td>Google Document AI</td>
163
+ <td>0.640</td>
164
+ <td>β€”</td>
165
+ <td>β€”</td>
166
+ </tr>
167
+ <tr>
168
+ <td>GPT-4o</td>
169
+ <td>0.635</td>
170
+ <td>β€”</td>
171
+ <td>β€”</td>
172
+ </tr>
173
+ <tr>
174
+ <td>Amazon Textract</td>
175
+ <td>0.618</td>
176
+ <td>β€”</td>
177
+ <td>β€”</td>
178
+ </tr>
179
+ <tr>
180
+ <td>Mistral OCR 3</td>
181
+ <td>0.574</td>
182
+ <td>β€”</td>
183
+ <td>β€”</td>
184
+ </tr>
185
+
186
+
187
  </tbody>
188
  </table>
189