Failed to create stream: inference request failed: failed to generate stream from Vercel: failed to invoke model ‘deepseek/deepseek-v4.1-flash’ with streaming: request failed with status 429: {“error”:{“message”:“Rate limit exceeded for deepseek/deepseek-v4.1-flash: this team’s limit of 100000000 input tokens per minute (per region) was reached. Retry after 3s.”,“type”:“rate_limit_exceeded”,“param”:{“error”:“Rate limit exceeded for deepseek/deepseek-v4.1-flash: this team’s limit of 100000000 input tokens per minute (per region) was reached. Retry after 3s.”,“type”:“rate_limit_exceeded”,“statusCode”:429,“name”:“RateLimitExceededError”,“message”:“Rate limit exceeded for deepseek/deepseek-v4.1-flash: this team’s limit of 100000000 input tokens per minute (per region) was reached. Retry after 3s.”}},“providerMetadata”:{“gateway”:{“routing”:{“originalModelId”:“deepseek/deepseek-v4.1-flash”,“resolvedProvider”:“deepseek”,“fallbacksAvailable”:[“fireworks”,“alibaba”,“runware”,“relace”,“particle”,“novita”,“togetherai”,“deepinfra”,“wafer”,“parasail”,“gmicloud”,“modal”,“morph”,“deepseek”,“runinfra”,“boundless”],“canonicalSlug”:“deepseek/deepseek-v4.1-flash”,“modelAttemptCount”:1,“modelAttempts”:[{“canonicalSlug”:“deepseek/deepseek-v4.1-flash”,“success”:false,“providerAttemptCount”:0,“providerAttempts”:}],“totalProviderAttemptCount”:0,“affinity”:{“outcome”:“promoted”,“pinnedProvider”:“deepseek”,“displacedProvider”:“baseten”},“clientSessionId”:“sess-",“clientSessionIdSource”:“explicit”},“generationId”:"gen_”}}}