返回提交历史
Modified
docs/providers-and-models.md
+2
-2
Modified
g4f/Provider/airforce/AirforceChat.py
+27
-234
Modified
g4f/models.py
+42
-202
XFEstudio/gpt4free
Update (g4f/models.py g4f/Provider/airforce/AirforceChat.py docs/providers-and-models.md)
3a15957d
代码差异
3 个文件
+71
-438
@@ -19,8 +19,8 @@ This document provides an overview of various AI providers and models, including
19
19
|----------|-------------|--------------|---------------|--------|--------|------|
20
20
|[ai4chat.co](https://www.ai4chat.co)|`g4f.Provider.Ai4Chat`|`gpt-4`|❌|❌|✔||❌|
21
21
|[aichatfree.info](https://aichatfree.info)|`g4f.Provider.AIChatFree`|`gemini-pro`|❌|❌|✔||❌|
22
|[api.airforce](https://api.airforce)|`g4f.Provider.AiMathGPT`|`llama-3.1-70b`|❌|❌|✔||❌|
23
|[api.airforce](https://api.airforce)|`g4f.Provider.Airforce`|`claude-3-haiku, claude-3-sonnet, claude-3-opus, gpt-4, gpt-4-turbo, gpt-4o-mini, gpt-3.5-turbo, llama-3-70b, llama-3-8b, llama-2-13b, llama-3.1-405b, llama-3.1-70b, llama-3.1-8b, llamaguard-2-8b, llamaguard-7b, llama-3.2-90b, llamaguard-3-8b, llama-3.2-11b, llamaguard-3-11b, llama-3.2-3b, llama-3.2-1b, llama-2-7b, mixtral-8x7b, mixtral-8x22b, mythomax-13b, openchat-3.5, qwen-2-72b, qwen-2-5-7b, qwen-2-5-72b, gemma-2b, gemma-2-9b, gemma-2b-27b, gemini-flash, gemini-pro, dbrx-instruct, deepseek-coder, hermes-2-dpo, hermes-2, openhermes-2.5, wizardlm-2-8x22b, phi-2, solar-10-7b, cosmosrp, lfm-40b, german-7b, zephyr-7b`|`flux, flux-realism', flux-anime, flux-3d, flux-disney, flux-pixel, flux-4o, any-dark, sdxl`|❌|✔||❌|
22
|[aimathgpt.forit.ai](https://aimathgpt.forit.ai)|`g4f.Provider.AiMathGPT`|`llama-3.1-70b`|❌|❌|✔||❌|
23
|[api.airforce](https://api.airforce)|`g4f.Provider.Airforce`|`gpt-4o, gpt-4o-mini, gpt-4-turbo, llama-2-7b, llama-3.1-8b, llama-3.1-70b, hermes-2-pro, hermes-2-dpo, phi-2, deepseek-coder, openchat-3.5, openhermes-2.5, cosmosrp, lfm-40b, german-7b, zephyr-7b, neural-7b`|`flux, flux-realism', flux-anime, flux-3d, flux-disney, flux-pixel, flux-4o, any-dark, sdxl`|❌|✔||❌|
24
24
|[aiuncensored.info](https://www.aiuncensored.info)|`g4f.Provider.AIUncensored`|✔|✔|❌|✔||❌|
25
25
|[allyfy.chat](https://allyfy.chat/)|`g4f.Provider.Allyfy`|`gpt-3.5-turbo`|❌|❌|✔||❌|
26
26
|[bing.com](https://bing.com/chat)|`g4f.Provider.Bing`|`gpt-4`|✔|`gpt-4-vision`|✔||❌+✔|
@@ -3,6 +3,7 @@ import re
3
3
from aiohttp import ClientSession
4
4
import json
5
5
from typing import List
6
import requests
6
7
7
8
from ...typing import AsyncResult, Messages
8
9
from ..base_provider import AsyncGeneratorProvider, ProviderModelMixin
@@ -51,258 +52,50 @@ class AirforceChat(AsyncGeneratorProvider, ProviderModelMixin):
51
52
supports_system_message = True
52
53
supports_message_history = True
53
54
54
default_model = 'llama-3-70b-chat'
55
text_models = [
56
# anthropic
57
'claude-3-haiku-20240307',
58
'claude-3-sonnet-20240229',
59
'claude-3-5-sonnet-20240620',
60
'claude-3-5-sonnet-20241022',
61
'claude-3-opus-20240229',
62
63
# openai
64
'chatgpt-4o-latest',
65
'gpt-4',
66
'gpt-4-turbo',
67
'gpt-4o-2024-05-13',
68
'gpt-4o-mini-2024-07-18',
69
'gpt-4o-mini',
70
'gpt-4o-2024-08-06',
71
'gpt-3.5-turbo',
72
'gpt-3.5-turbo-0125',
73
'gpt-3.5-turbo-1106',
74
'gpt-4o',
75
'gpt-4-turbo-2024-04-09',
76
'gpt-4-0125-preview',
77
'gpt-4-1106-preview',
78
79
# meta-llama
80
default_model,
81
'llama-3-70b-chat-turbo',
82
'llama-3-8b-chat',
83
'llama-3-8b-chat-turbo',
84
'llama-3-70b-chat-lite',
85
'llama-3-8b-chat-lite',
86
'llama-2-13b-chat',
87
'llama-3.1-405b-turbo',
88
'llama-3.1-70b-turbo',
89
'llama-3.1-8b-turbo',
90
'LlamaGuard-2-8b',
91
'llamaguard-7b',
92
'Llama-Vision-Free',
93
'Llama-Guard-7b',
94
'Llama-3.2-90B-Vision-Instruct-Turbo',
95
'Meta-Llama-Guard-3-8B',
96
'Llama-3.2-11B-Vision-Instruct-Turbo',
97
'Llama-Guard-3-11B-Vision-Turbo',
98
'Llama-3.2-3B-Instruct-Turbo',
99
'Llama-3.2-1B-Instruct-Turbo',
100
'llama-2-7b-chat-int8',
101
'llama-2-7b-chat-fp16',
102
'Llama 3.1 405B Instruct',
103
'Llama 3.1 70B Instruct',
104
'Llama 3.1 8B Instruct',
105
106
# mistral-ai
107
'Mixtral-8x7B-Instruct-v0.1',
108
'Mixtral-8x22B-Instruct-v0.1',
109
'Mistral-7B-Instruct-v0.1',
110
'Mistral-7B-Instruct-v0.2',
111
'Mistral-7B-Instruct-v0.3',
112
113
# Gryphe
114
'MythoMax-L2-13b-Lite',
115
'MythoMax-L2-13b',
116
117
# openchat
118
'openchat-3.5-0106',
119
120
# qwen
121
#'Qwen1.5-72B-Chat', # Empty answer
122
#'Qwen1.5-110B-Chat', # Empty answer
123
'Qwen2-72B-Instruct',
124
'Qwen2.5-7B-Instruct-Turbo',
125
'Qwen2.5-72B-Instruct-Turbo',
126
127
# google
128
'gemma-2b-it',
129
'gemma-2-9b-it',
130
'gemma-2-27b-it',
131
132
# gemini
133
'gemini-1.5-flash',
134
'gemini-1.5-pro',
135
136
# databricks
137
'dbrx-instruct',
138
139
# deepseek-ai
140
'deepseek-coder-6.7b-base',
141
'deepseek-coder-6.7b-instruct',
142
'deepseek-math-7b-instruct',
143
144
# NousResearch
145
'deepseek-math-7b-instruct',
146
'Nous-Hermes-2-Mixtral-8x7B-DPO',
147
'hermes-2-pro-mistral-7b',
148
149
# teknium
150
'openhermes-2.5-mistral-7b',
151
152
# microsoft
153
'WizardLM-2-8x22B',
154
'phi-2',
155
156
# upstage
157
'SOLAR-10.7B-Instruct-v1.0',
158
159
# pawan
160
'cosmosrp',
161
162
# liquid
163
'lfm-40b-moe',
164
165
# DiscoResearch
166
'discolm-german-7b-v1',
167
168
# tiiuae
169
'falcon-7b-instruct',
170
171
# defog
172
'sqlcoder-7b-2',
173
174
# tinyllama
175
'tinyllama-1.1b-chat',
176
177
# HuggingFaceH4
178
'zephyr-7b-beta',
179
]
55
default_model = 'llama-3.1-70b-chat'
56
response = requests.get('https://api.airforce/models')
57
data = response.json()
58
59
text_models = [model['id'] for model in data['data']]
180
60
181
61
models = [*text_models]
182
62
183
63
model_aliases = {
184
# anthropic
185
"claude-3-haiku": "claude-3-haiku-20240307",
186
"claude-3-sonnet": "claude-3-sonnet-20240229",
187
"claude-3.5-sonnet": "claude-3-5-sonnet-20240620",
188
"claude-3.5-sonnet": "claude-3-5-sonnet-20241022",
189
"claude-3-opus": "claude-3-opus-20240229",
190
191
# openai
192
"gpt-4o": "chatgpt-4o-latest",
193
#"gpt-4": "gpt-4",
194
#"gpt-4-turbo": "gpt-4-turbo",
195
"gpt-4o": "gpt-4o-2024-05-13",
196
"gpt-4o-mini": "gpt-4o-mini-2024-07-18",
197
#"gpt-4o-mini": "gpt-4o-mini",
198
"gpt-4o": "gpt-4o-2024-08-06",
199
"gpt-3.5-turbo": "gpt-3.5-turbo",
200
"gpt-3.5-turbo": "gpt-3.5-turbo-0125",
201
"gpt-3.5-turbo": "gpt-3.5-turbo-1106",
202
#"gpt-4o": "gpt-4o",
203
"gpt-4-turbo": "gpt-4-turbo-2024-04-09",
204
"gpt-4": "gpt-4-0125-preview",
205
"gpt-4": "gpt-4-1106-preview",
206
207
# meta-llama
208
"llama-3-70b": "llama-3-70b-chat",
209
"llama-3-8b": "llama-3-8b-chat",
210
"llama-3-8b": "llama-3-8b-chat-turbo",
211
"llama-3-70b": "llama-3-70b-chat-lite",
212
"llama-3-8b": "llama-3-8b-chat-lite",
213
"llama-2-13b": "llama-2-13b-chat",
214
"llama-3.1-405b": "llama-3.1-405b-turbo",
215
"llama-3.1-70b": "llama-3.1-70b-turbo",
216
"llama-3.1-8b": "llama-3.1-8b-turbo",
217
"llamaguard-2-8b": "LlamaGuard-2-8b",
218
"llamaguard-7b": "llamaguard-7b",
219
#"llama_vision_free": "Llama-Vision-Free", # Unknown
220
"llamaguard-7b": "Llama-Guard-7b",
221
"llama-3.2-90b": "Llama-3.2-90B-Vision-Instruct-Turbo",
222
"llamaguard-3-8b": "Meta-Llama-Guard-3-8B",
223
"llama-3.2-11b": "Llama-3.2-11B-Vision-Instruct-Turbo",
224
"llamaguard-3-11b": "Llama-Guard-3-11B-Vision-Turbo",
225
"llama-3.2-3b": "Llama-3.2-3B-Instruct-Turbo",
226
"llama-3.2-1b": "Llama-3.2-1B-Instruct-Turbo",
227
"llama-2-7b": "llama-2-7b-chat-int8",
228
"llama-2-7b": "llama-2-7b-chat-fp16",
229
"llama-3.1-405b": "Llama 3.1 405B Instruct",
230
"llama-3.1-70b": "Llama 3.1 70B Instruct",
231
"llama-3.1-8b": "Llama 3.1 8B Instruct",
232
233
# mistral-ai
234
"mixtral-8x7b": "Mixtral-8x7B-Instruct-v0.1",
235
"mixtral-8x22b": "Mixtral-8x22B-Instruct-v0.1",
236
"mixtral-8x7b": "Mistral-7B-Instruct-v0.1",
237
"mixtral-8x7b": "Mistral-7B-Instruct-v0.2",
238
"mixtral-8x7b": "Mistral-7B-Instruct-v0.3",
239
240
# Gryphe
241
"mythomax-13b": "MythoMax-L2-13b-Lite",
242
"mythomax-13b": "MythoMax-L2-13b",
243
244
64
# openchat
245
65
"openchat-3.5": "openchat-3.5-0106",
246
247
# qwen
248
#"qwen-1.5-72b": "Qwen1.5-72B-Chat", # Empty answer
249
#"qwen-1.5-110b": "Qwen1.5-110B-Chat", # Empty answer
250
"qwen-2-72b": "Qwen2-72B-Instruct",
251
"qwen-2-5-7b": "Qwen2.5-7B-Instruct-Turbo",
252
"qwen-2-5-72b": "Qwen2.5-72B-Instruct-Turbo",
253
254
# google
255
"gemma-2b": "gemma-2b-it",
256
"gemma-2-9b": "gemma-2-9b-it",
257
"gemma-2b-27b": "gemma-2-27b-it",
258
259
# gemini
260
"gemini-flash": "gemini-1.5-flash",
261
"gemini-pro": "gemini-1.5-pro",
262
263
# databricks
264
"dbrx-instruct": "dbrx-instruct",
265
66
266
67
# deepseek-ai
267
#"deepseek-coder": "deepseek-coder-6.7b-base",
268
68
"deepseek-coder": "deepseek-coder-6.7b-instruct",
269
#"deepseek-math": "deepseek-math-7b-instruct",
270
69
271
70
# NousResearch
272
#"deepseek-math": "deepseek-math-7b-instruct",
273
71
"hermes-2-dpo": "Nous-Hermes-2-Mixtral-8x7B-DPO",
274
"hermes-2": "hermes-2-pro-mistral-7b",
275
72
"hermes-2-pro": "hermes-2-pro-mistral-7b",
73
276
74
# teknium
277
75
"openhermes-2.5": "openhermes-2.5-mistral-7b",
278
279
# microsoft
280
"wizardlm-2-8x22b": "WizardLM-2-8x22B",
281
#"phi-2": "phi-2",
282
283
# upstage
284
"solar-10-7b": "SOLAR-10.7B-Instruct-v1.0",
285
286
# pawan
287
#"cosmosrp": "cosmosrp",
288
76
289
77
# liquid
290
78
"lfm-40b": "lfm-40b-moe",
291
79
292
80
# DiscoResearch
293
81
"german-7b": "discolm-german-7b-v1",
294
295
# tiiuae
296
#"falcon-7b": "falcon-7b-instruct",
297
298
# defog
299
#"sqlcoder-7b": "sqlcoder-7b-2",
300
301
# tinyllama
302
#"tinyllama-1b": "tinyllama-1.1b-chat",
303
82
83
# meta-llama
84
"llama-2-7b": "llama-2-7b-chat-int8",
85
"llama-2-7b": "llama-2-7b-chat-fp16",
86
"llama-3.1-70b": "llama-3.1-70b-chat",
87
"llama-3.1-8b": "llama-3.1-8b-chat",
88
"llama-3.1-70b": "llama-3.1-70b-turbo",
89
"llama-3.1-8b": "llama-3.1-8b-turbo",
90
91
# inferless
92
"neural-7b": "neural-chat-7b-v3-1",
93
304
94
# HuggingFaceH4
305
95
"zephyr-7b": "zephyr-7b-beta",
96
97
# llmplayground.net
98
#"any-uncensored": "any-uncensored",
306
99
}
307
100
308
101
@classmethod
@@ -98,32 +98,32 @@ default = Model(
98
98
gpt_35_turbo = Model(
99
99
name = 'gpt-3.5-turbo',
100
100
base_provider = 'OpenAI',
101
best_provider = IterListProvider([DarkAI, Airforce, Liaobots, Allyfy])
101
best_provider = IterListProvider([DarkAI, Liaobots, Allyfy])
102
102
)
103
103
104
104
# gpt-4
105
105
gpt_4o = Model(
106
106
name = 'gpt-4o',
107
107
base_provider = 'OpenAI',
108
best_provider = IterListProvider([Blackbox, ChatGptEs, DarkAI, Airforce, ChatGpt, Liaobots, OpenaiChat])
108
best_provider = IterListProvider([Blackbox, ChatGptEs, DarkAI, ChatGpt, Airforce, Liaobots, OpenaiChat])
109
109
)
110
110
111
111
gpt_4o_mini = Model(
112
112
name = 'gpt-4o-mini',
113
113
base_provider = 'OpenAI',
114
best_provider = IterListProvider([DDG, ChatGptEs, FreeNetfly, Pizzagpt, MagickPen, RubiksAI, Liaobots, ChatGpt, Airforce, OpenaiChat])
114
best_provider = IterListProvider([DDG, ChatGptEs, FreeNetfly, Pizzagpt, MagickPen, ChatGpt, Airforce, RubiksAI, Liaobots, OpenaiChat])
115
115
)
116
116
117
117
gpt_4_turbo = Model(
118
118
name = 'gpt-4-turbo',
119
119
base_provider = 'OpenAI',
120
best_provider = IterListProvider([Liaobots, Airforce, ChatGpt, Bing])
120
best_provider = IterListProvider([ChatGpt, Airforce, Liaobots, Bing])
121
121
)
122
122
123
123
gpt_4 = Model(
124
124
name = 'gpt-4',
125
125
base_provider = 'OpenAI',
126
best_provider = IterListProvider([Chatgpt4Online, Ai4Chat, ChatGpt, Airforce, Bing, OpenaiChat, gpt_4_turbo.best_provider, gpt_4o.best_provider, gpt_4o_mini.best_provider])
126
best_provider = IterListProvider([Chatgpt4Online, ChatGpt, Bing, OpenaiChat, gpt_4_turbo.best_provider, gpt_4o.best_provider, gpt_4o_mini.best_provider])
127
127
)
128
128
129
129
# o1
@@ -161,24 +161,17 @@ llama_2_7b = Model(
161
161
base_provider = "Meta Llama",
162
162
best_provider = IterListProvider([Cloudflare, Airforce])
163
163
)
164
165
llama_2_13b = Model(
166
name = "llama-2-13b",
167
base_provider = "Meta Llama",
168
best_provider = Airforce
169
)
170
171
164
# llama 3
172
165
llama_3_8b = Model(
173
166
name = "llama-3-8b",
174
167
base_provider = "Meta Llama",
175
best_provider = IterListProvider([Cloudflare, Airforce])
168
best_provider = IterListProvider([Cloudflare])
176
169
)
177
170
178
171
llama_3_70b = Model(
179
172
name = "llama-3-70b",
180
173
base_provider = "Meta Llama",
181
best_provider = IterListProvider([ReplicateHome, Airforce])
174
best_provider = IterListProvider([ReplicateHome])
182
175
)
183
176
184
177
# llama 3.1
@@ -191,84 +184,39 @@ llama_3_1_8b = Model(
191
184
llama_3_1_70b = Model(
192
185
name = "llama-3.1-70b",
193
186
base_provider = "Meta Llama",
194
best_provider = IterListProvider([DDG, DeepInfraChat, Blackbox, TeachAnything, DarkAI, AiMathGPT, RubiksAI, Airforce, HuggingChat, HuggingFace, PerplexityLabs])
187
best_provider = IterListProvider([DDG, DeepInfraChat, Blackbox, TeachAnything, DarkAI, AiMathGPT, Airforce, RubiksAI, HuggingChat, HuggingFace, PerplexityLabs])
195
188
)
196
189
197
190
llama_3_1_405b = Model(
198
191
name = "llama-3.1-405b",
199
192
base_provider = "Meta Llama",
200
best_provider = IterListProvider([Blackbox, DarkAI, Airforce])
193
best_provider = IterListProvider([Blackbox, DarkAI])
201
194
)
202
195
203
196
# llama 3.2
204
197
llama_3_2_1b = Model(
205
198
name = "llama-3.2-1b",
206
199
base_provider = "Meta Llama",
207
best_provider = IterListProvider([Cloudflare, Airforce])
208
)
209
210
llama_3_2_3b = Model(
211
name = "llama-3.2-3b",
212
base_provider = "Meta Llama",
213
best_provider = IterListProvider([Airforce])
200
best_provider = IterListProvider([Cloudflare])
214
201
)
215
202
216
203
llama_3_2_11b = Model(
217
204
name = "llama-3.2-11b",
218
205
base_provider = "Meta Llama",
219
best_provider = IterListProvider([HuggingChat, Airforce, HuggingFace])
220
)
221
222
llama_3_2_90b = Model(
223
name = "llama-3.2-90b",
224
base_provider = "Meta Llama",
225
best_provider = IterListProvider([Airforce])
226
)
227
228
229
# llamaguard
230
llamaguard_7b = Model(
231
name = "llamaguard-7b",
232
base_provider = "Meta Llama",
233
best_provider = Airforce
234
)
235
236
llamaguard_2_8b = Model(
237
name = "llamaguard-2-8b",
238
base_provider = "Meta Llama",
239
best_provider = Airforce
240
)
241
242
llamaguard_3_8b = Model(
243
name = "llamaguard-3-8b",
244
base_provider = "Meta Llama",
245
best_provider = Airforce
246
)
247
248
llamaguard_3_11b = Model(
249
name = "llamaguard-3-11b",
250
base_provider = "Meta Llama",
251
best_provider = Airforce
206
best_provider = IterListProvider([HuggingChat, HuggingFace])
252
207
)
253
208
254
255
209
### Mistral ###
256
210
mistral_7b = Model(
257
211
name = "mistral-7b",
258
212
base_provider = "Mistral",
259
best_provider = IterListProvider([Free2GPT, Airforce])
213
best_provider = IterListProvider([Free2GPT])
260
214
)
261
215
262
216
mixtral_8x7b = Model(
263
217
name = "mixtral-8x7b",
264
218
base_provider = "Mistral",
265
best_provider = IterListProvider([DDG, ReplicateHome, Airforce])
266
)
267
268
mixtral_8x22b = Model(
269
name = "mixtral-8x22b",
270
base_provider = "Mistral",
271
best_provider = IterListProvider([Airforce])
219
best_provider = IterListProvider([DDG, ReplicateHome])
272
220
)
273
221
274
222
mistral_nemo = Model(
@@ -279,8 +227,8 @@ mistral_nemo = Model(
279
227
280
228
281
229
### NousResearch ###
282
hermes_2 = Model(
283
name = "hermes-2",
230
hermes_2_pro = Model(
231
name = "hermes-2-pro",
284
232
base_provider = "NousResearch",
285
233
best_provider = Airforce
286
234
)
@@ -305,12 +253,6 @@ phi_2 = Model(
305
253
best_provider = IterListProvider([Cloudflare, Airforce])
306
254
)
307
255
308
phi_3_medium_4k = Model(
309
name = "phi-3-medium-4k",
310
base_provider = "Microsoft",
311
best_provider = None
312
)
313
314
256
phi_3_5_mini = Model(
315
257
name = "phi-3.5-mini",
316
258
base_provider = "Microsoft",
@@ -322,13 +264,13 @@ phi_3_5_mini = Model(
322
264
gemini_pro = Model(
323
265
name = 'gemini-pro',
324
266
base_provider = 'Google DeepMind',
325
best_provider = IterListProvider([GeminiPro, Blackbox, AIChatFree, FreeGpt, Airforce, Liaobots])
267
best_provider = IterListProvider([GeminiPro, Blackbox, AIChatFree, FreeGpt, Liaobots])
326
268
)
327
269
328
270
gemini_flash = Model(
329
271
name = 'gemini-flash',
330
272
base_provider = 'Google DeepMind',
331
best_provider = IterListProvider([Blackbox, GizAI, Airforce, Liaobots])
273
best_provider = IterListProvider([Blackbox, GizAI, Liaobots])
332
274
)
333
275
334
276
gemini = Model(
@@ -341,13 +283,7 @@ gemini = Model(
341
283
gemma_2b = Model(
342
284
name = 'gemma-2b',
343
285
base_provider = 'Google',
344
best_provider = IterListProvider([ReplicateHome, Airforce])
345
)
346
347
gemma_2b_27b = Model(
348
name = 'gemma-2b-27b',
349
base_provider = 'Google',
350
best_provider = IterListProvider([Airforce])
286
best_provider = IterListProvider([ReplicateHome])
351
287
)
352
288
353
289
gemma_7b = Model(
@@ -356,13 +292,6 @@ gemma_7b = Model(
356
292
best_provider = Cloudflare
357
293
)
358
294
359
# gemma 2
360
gemma_2_9b = Model(
361
name = 'gemma-2-9b',
362
base_provider = 'Google',
363
best_provider = Airforce
364
)
365
366
295
367
296
### Anthropic ###
368
297
claude_2_1 = Model(
@@ -419,15 +348,6 @@ blackboxai_pro = Model(
419
348
best_provider = Blackbox
420
349
)
421
350
422
423
### Databricks ###
424
dbrx_instruct = Model(
425
name = 'dbrx-instruct',
426
base_provider = 'Databricks',
427
best_provider = IterListProvider([Airforce])
428
)
429
430
431
351
### CohereForAI ###
432
352
command_r_plus = Model(
433
353
name = 'command-r-plus',
@@ -466,28 +386,10 @@ qwen_1_5_14b = Model(
466
386
qwen_2_72b = Model(
467
387
name = 'qwen-2-72b',
468
388
base_provider = 'Qwen',
469
best_provider = IterListProvider([DeepInfraChat, HuggingChat, Airforce, HuggingFace])
470
)
471
472
qwen_2_5_7b = Model(
473
name = 'qwen-2-5-7b',
474
base_provider = 'Qwen',
475
best_provider = Airforce
476
)
477
478
qwen_2_5_72b = Model(
479
name = 'qwen-2-5-72b',
480
base_provider = 'Qwen',
481
best_provider = Airforce
389
best_provider = IterListProvider([DeepInfraChat, HuggingChat, HuggingFace])
482
390
)
483
391
484
392
### Upstage ###
485
solar_10_7b = Model(
486
name = 'solar-10-7b',
487
base_provider = 'Upstage',
488
best_provider = Airforce
489
)
490
491
393
solar_mini = Model(
492
394
name = 'solar-mini',
493
395
base_provider = 'Upstage',
@@ -519,7 +421,7 @@ deepseek_coder = Model(
519
421
wizardlm_2_8x22b = Model(
520
422
name = 'wizardlm-2-8x22b',
521
423
base_provider = 'WizardLM',
522
best_provider = IterListProvider([DeepInfraChat, Airforce])
424
best_provider = IterListProvider([DeepInfraChat])
523
425
)
524
426
525
427
### Yorickvp ###
@@ -529,44 +431,11 @@ llava_13b = Model(
529
431
best_provider = ReplicateHome
530
432
)
531
433
532
533
### OpenBMB ###
534
minicpm_llama_3_v2_5 = Model(
535
name = 'minicpm-llama-3-v2.5',
536
base_provider = 'OpenBMB',
537
best_provider = None
538
)
539
540
541
### Lzlv ###
542
lzlv_70b = Model(
543
name = 'lzlv-70b',
544
base_provider = 'Lzlv',
545
best_provider = None
546
)
547
548
549
434
### OpenChat ###
550
openchat_3_6_8b = Model(
551
name = 'openchat-3.6-8b',
435
openchat_3_5 = Model(
436
name = 'openchat-3.5',
552
437
base_provider = 'OpenChat',
553
best_provider = None
554
)
555
556
557
### Phind ###
558
phind_codellama_34b_v2 = Model(
559
name = 'phind-codellama-34b-v2',
560
base_provider = 'Phind',
561
best_provider = None
562
)
563
564
565
### Cognitive Computations ###
566
dolphin_2_9_1_llama_3_70b = Model(
567
name = 'dolphin-2.9.1-llama-3-70b',
568
base_provider = 'Cognitive Computations',
569
best_provider = None
438
best_provider = Airforce
570
439
)
571
440
572
441
@@ -650,6 +519,13 @@ zephyr_7b = Model(
650
519
best_provider = Airforce
651
520
)
652
521
522
### Inferless ###
523
neural_7b = Model(
524
name = 'neural-7b',
525
base_provider = 'inferless',
526
best_provider = Airforce
527
)
528
653
529
654
530
655
531
#############
@@ -660,7 +536,7 @@ zephyr_7b = Model(
660
536
sdxl = Model(
661
537
name = 'sdxl',
662
538
base_provider = 'Stability AI',
663
best_provider = IterListProvider([ReplicateHome, Airforce])
539
best_provider = IterListProvider([ReplicateHome])
664
540
665
541
)
666
542
@@ -740,7 +616,7 @@ flux_4o = Model(
740
616
flux_schnell = Model(
741
617
name = 'flux-schnell',
742
618
base_provider = 'Flux AI',
743
best_provider = IterListProvider([ReplicateHome])
619
best_provider = ReplicateHome
744
620
745
621
)
746
622
@@ -786,7 +662,6 @@ class ModelUtils:
786
662
787
663
# llama-2
788
664
'llama-2-7b': llama_2_7b,
789
'llama-2-13b': llama_2_13b,
790
665
791
666
# llama-3
792
667
'llama-3-8b': llama_3_8b,
@@ -799,33 +674,23 @@ class ModelUtils:
799
674
800
675
# llama-3.2
801
676
'llama-3.2-1b': llama_3_2_1b,
802
'llama-3.2-3b': llama_3_2_3b,
803
677
'llama-3.2-11b': llama_3_2_11b,
804
'llama-3.2-90b': llama_3_2_90b,
805
806
# llamaguard
807
'llamaguard-7b': llamaguard_7b,
808
'llamaguard-2-8b': llamaguard_2_8b,
809
'llamaguard-3-8b': llamaguard_3_8b,
810
'llamaguard-3-11b': llamaguard_3_11b,
811
678
812
679
813
680
### Mistral ###
814
681
'mistral-7b': mistral_7b,
815
682
'mixtral-8x7b': mixtral_8x7b,
816
'mixtral-8x22b': mixtral_8x22b,
817
683
'mistral-nemo': mistral_nemo,
818
684
819
685
820
686
### NousResearch ###
821
'hermes-2': hermes_2,
687
'hermes-2-pro': hermes_2_pro,
822
688
'hermes-2-dpo': hermes_2_dpo,
823
689
'hermes-3': hermes_3,
824
690
825
691
826
692
### Microsoft ###
827
693
'phi-2': phi_2,
828
'phi_3_medium-4k': phi_3_medium_4k,
829
694
'phi-3.5-mini': phi_3_5_mini,
830
695
831
696
@@ -837,12 +702,8 @@ class ModelUtils:
837
702
838
703
# gemma
839
704
'gemma-2b': gemma_2b,
840
'gemma-2b-27b': gemma_2b_27b,
841
705
'gemma-7b': gemma_7b,
842
706
843
# gemma-2
844
'gemma-2-9b': gemma_2_9b,
845
846
707
847
708
### Anthropic ###
848
709
'claude-2.1': claude_2_1,
@@ -868,10 +729,6 @@ class ModelUtils:
868
729
### CohereForAI ###
869
730
'command-r+': command_r_plus,
870
731
871
872
### Databricks ###
873
'dbrx-instruct': dbrx_instruct,
874
875
732
876
733
### GigaChat ###
877
734
'gigachat': gigachat,
@@ -887,14 +744,9 @@ class ModelUtils:
887
744
888
745
# qwen 2
889
746
'qwen-2-72b': qwen_2_72b,
890
891
# qwen 2-5
892
'qwen-2-5-7b': qwen_2_5_7b,
893
'qwen-2-5-72b': qwen_2_5_72b,
894
747
895
748
896
749
### Upstage ###
897
'solar-10-7b': solar_10_7b,
898
750
'solar-mini': solar_mini,
899
751
'solar-pro': solar_pro,
900
752
@@ -913,27 +765,11 @@ class ModelUtils:
913
765
914
766
### WizardLM ###
915
767
'wizardlm-2-8x22b': wizardlm_2_8x22b,
916
917
918
### OpenBMB ###
919
'minicpm-llama-3-v2.5': minicpm_llama_3_v2_5,
920
921
922
### Lzlv ###
923
'lzlv-70b': lzlv_70b,
924
768
925
769
926
770
### OpenChat ###
927
'openchat-3.6-8b': openchat_3_6_8b,
928
929
930
### Phind ###
931
'phind-codellama-34b-v2': phind_codellama_34b_v2,
932
933
934
### Cognitive Computations ###
935
'dolphin-2.9.1-llama-3-70b': dolphin_2_9_1_llama_3_70b,
936
771
'openchat-3.5': openchat_3_5,
772
937
773
938
774
### x.ai ###
939
775
'grok-2': grok_2,
@@ -972,6 +808,10 @@ class ModelUtils:
972
808
973
809
### HuggingFaceH4 ###
974
810
'zephyr-7b': zephyr_7b,
811
812
813
### Inferless ###
814
'neural-7b': neural_7b,
975
815
976
816
977
817