iTerminal now includes advanced hyperthreading optimization to significantly improve response time for AI requests. This feature parallelizes API requests to Ollama, making better use of modern CPU architectures.
- Faster Response Times: Up to 40-60% improvement in AI response speed
- Better Resource Utilization: Makes full use of your CPU's hyperthreading capabilities
- Parallel API Requests: Handles multiple requests simultaneously for better throughput
- Optimized for Modern CPUs: Automatically adjusts based on your system's capabilities
./scripts/hyperthread_iterminal.shAdd or modify these settings in your .env file:
ITERMINAL_HYPERTHREAD_ENABLED=true
ITERMINAL_MAX_CONCURRENT_TASKS=16
ITERMINAL_PARALLEL_REQUESTS=8
export ITERMINAL_HYPERTHREAD_ENABLED=true
export ITERMINAL_PARALLEL_REQUESTS=8
python iterminal.pyTo see the performance difference with hyperthreading:
./scripts/benchmark_hyperthread.py| Environment Variable | Description | Default Value |
|---|---|---|
| ITERMINAL_HYPERTHREAD_ENABLED | Enable/disable hyperthreading | true |
| ITERMINAL_MAX_CONCURRENT_TASKS | Maximum concurrent tasks | 16 (or 4x CPU cores) |
| ITERMINAL_PARALLEL_REQUESTS | Number of parallel API requests | 8 (or 2x CPU cores) |
| ITERMINAL_REQUEST_TIMEOUT | API request timeout in seconds | 60 |