v0.0.3-alpha20
Add safety server to inference (#2449)
Handle chat error (#2959)
Introduce model configs to abstract pairings of models and hardware (#2194)
Added max messages and max message length settings for inference (#2774)
Implement auto scroll when stream message (#2839)
adjusted token buffer to pop EOS
add translate button to important readme's (#2816)
inference: allow user change chat title (#2496)