ในการใช้งาน LLM model ต่าง ๆ นั้น จะคิดค่าใช้จ่าย และ limit ต่าง ๆ ผ่านจำนวน token ที่ใช้งาน ทั้ง Input/Output/Cache ต่อ 1 ล้าน token เสมอแต่มีสิ่งหนึ่งที่น่าสนใจคือ model ใหม่ ๆ กับ tokenizer ใหม่ ๆ นั้นจะมีจำนวน token มากขึ้น ๆ ทั้ง ๆ ที่ input ของเราคือของเดิมโดยสิ่งที่ใช้งานคือ source code นั่นเอง

Read More…