{"package": "guarded-hotshard", "summary": "Tenant-aware request scheduling for LLM inference. Cuts premium-tenant p99 latency 60-70% on a contested GPU at <5% extra cost.", "pypi_url": "https://pypi.org/project/guarded-hotshard", "piwheels_url": "https://www.piwheels.org/project/guarded-hotshard", "releases": {"0.2.0": {"released": "2026-05-02 05:28:37", "prerelease": false, "yanked": false, "skip_reason": "", "files": {"guarded_hotshard-0.2.0-py3-none-any.whl": {"file_url": "https://archive1.piwheels.org/simple/guarded-hotshard/guarded_hotshard-0.2.0-py3-none-any.whl", "filehash": "d313d99427bba1c6afd710347838a00333ff3f341b5e1601124530b5570c0cdd", "filesize": 37309, "builder_abi": "cp311", "file_abi_tag": "none", "platform": "any", "requires_python": ">=3.10", "apt_dependencies": [], "pip_dependencies": ["httpx", "numpy", "pydantic", "rich", "typer"]}}}, "0.1.0": {"released": "2026-05-02 05:12:57", "prerelease": false, "yanked": false, "skip_reason": "", "files": {"guarded_hotshard-0.1.0-py3-none-any.whl": {"file_url": "https://archive1.piwheels.org/simple/guarded-hotshard/guarded_hotshard-0.1.0-py3-none-any.whl", "filehash": "c412827e3397e0a4a77b354ded6e72cb20af6653110b1819216c4091d045abb6", "filesize": 33274, "builder_abi": "cp311", "file_abi_tag": "none", "platform": "any", "requires_python": ">=3.10", "apt_dependencies": [], "pip_dependencies": ["httpx", "numpy", "pydantic", "rich", "typer"]}}}}}