It would be very helpful to see how fast the AI responds i mean how many tokens per second (T/s) it processes. For example, in LM Studio, you can see this displayed under each message while the AI is generating a response. This would be extremely useful for tracking performance when adjusting settings.
It would be very helpful to see how fast the AI responds i mean how many tokens per second (T/s) it processes. For example, in LM Studio, you can see this displayed under each message while the AI is generating a response. This would be extremely useful for tracking performance when adjusting settings.