Ograniczanie liczby żądań

Wdrażanie AI na produkcję z FastAPI

Matt Eckerle

Software and Data Engineering Leader

Wprowadzenie do ograniczania żądań

sygnalizator świetlny

 

  • Cel: Kontroluje częstotliwość żądań API.
  • Odpowiedź: Zwraca HTTP 429 („Za dużo żądań"), gdy limit zostanie przekroczony.
Wdrażanie AI na produkcję z FastAPI

Jak działa ograniczanie żądań

Część 1 schematu blokowego wyjaśniającego ograniczanie liczby żądań

Wdrażanie AI na produkcję z FastAPI

Uwierzytelnianie przychodzących danych

Część 2 schematu blokowego wyjaśniającego ograniczanie liczby żądań

Wdrażanie AI na produkcję z FastAPI

Sprawdzanie limitu żądań

Część 3 schematu blokowego wyjaśniającego ograniczanie liczby żądań

Wdrażanie AI na produkcję z FastAPI

Konfiguracja API

from fastapi import FastAPI, Depends, HTTPException
from fastapi.security import APIKeyHeader
from pydantic import BaseModel

app = FastAPI()
model = SentimentAnalyzer(pkl_file_path)

API_KEY_HEADER = APIKeyHeader(name="X-API-Key")
API_KEY = "your-secret-key"
Wdrażanie AI na produkcję z FastAPI

Logika ogranicznika żądań

from datetime import datetime, timedelta

class RateLimiter:
    def __init__(self, requests_per_min: int = 10):
        self.requests_per_min = requests_per_min
        self.requests = defaultdict(list)

def is_rate_limited( self, api_key: str ) -> tuple[bool, int]:

Część 1 schematu blokowego logiki ograniczania liczby żądań

Wdrażanie AI na produkcję z FastAPI

Usuwanie starych żądań

from datetime import datetime, timedelta

class RateLimiter:
    def __init__(self, requests_per_min: int = 10):
        self.requests_per_min = requests_per_min
        self.requests = defaultdict(list)

def is_rate_limited( self, api_key: str ) -> tuple[bool, int]:
now = datetime.now() minute_ago = now - timedelta(minutes=1) self.requests[api_key] = [ req_time for req_time in self.requests[api_key] if req_time > minute_ago ]

Część 2 schematu blokowego wyjaśniającego ograniczanie liczby żądań

Wdrażanie AI na produkcję z FastAPI

Sprawdzanie liczby żądań

    def is_rate_limited(self, api_key: str) -> 
  tuple[bool, int]:
        now = datetime.now()
        minute_ago = now - timedelta(minutes=1)

self.requests[api_key] = [ req_time for req_time in self.requests[api_key] if req_time > minute_ago ]
recent_requests = len(self.requests[api_key]) if recent_requests >= self.requests_per_min: return True, 0 self.requests[api_key].append(now) return False

Diagram przedstawiający sprawdzanie liczby żądań API: jeśli liczba jest większa lub równa limitowi, zwróć true, w przeciwnym razie false.

Wdrażanie AI na produkcję z FastAPI

Dodawanie sprawdzania limitu żądań

rate_limiter = RateLimiter(requests_per_minute=10)

def test_api_key(api_key: str = Depends(API_KEY_HEADER)): if api_key != API_KEY: raise HTTPException( status_code=403, detail="Invalid API key" ) is_limited, _ = rate_limiter.is_rate_limited(api_key) if is_limited: raise HTTPException( status_code=429, detail="Rate limit exceeded. Please try again later." ) return api_key
Wdrażanie AI na produkcję z FastAPI

Stosowanie limitu żądań do punktu końcowego

@app.post("/predict")
def predict_sentiment(
    request: SentimentRequest,
    api_key: str = Depends(test_api_key)
):
    result = sentiment_model(request.text)

    _, requests_remaining = 
           rate_limiter.is_rate_limited(api_key)

    return {
        "text": request.text,
        "sentiment": result[0]["label"].lower(),
        "confidence": result[0]["score"],
        "requests_remaining": requests_remaining
    }

Wyślij żądanie 11 razy:

curl -X POST "http://localhost:8000/predict" \
     -H "Content-Type: application/json" \
     -H "X-API-Key: your-secret-key" \
     -d '{"text": "I love this product"}'

Wynik:

{"detail":"Rate limit exceeded. 
           Please try again later."}
Wdrażanie AI na produkcję z FastAPI

Czas na ćwiczenia!

Wdrażanie AI na produkcję z FastAPI

Preparing Video For Download...