
Claude асуултанд хэрхэн хариулдаг вэ?

З.Номин-Эрдэнэ
Багш


З.Номин-Эрдэнэ
Багш
Хэрэглэгч апп дээр мессеж бичээд илгээхээс эхлээд, дэлгэц дээр Claude-ийн хариулт гарч ирэх хүртэл дараах таван үе шат дамждаг:

Хэрэгдэгчээс серверт — хэрэглэгчийн бичсэн текст таны өөрийн сервер рүү очно.
Серверээс Anthropic API руу — сервер нь API түлхүүрээ ашиглан хүсэлтийг дамжуулна.
Загварын боловсруулалт — Claude оролтыг уншиж, хариугаа үүсгэнэ.
API-аас сервер рүү — бүтэцлэгдсэн JSON хариу буцна.
Серверээс хэрэглэгч рүү — үүссэн текст хэрэглэгчийн дэлгэц дээр гарна.
Anthropic API руу шууд хөтчийн код буюу гар утасны аппликейшнаас хандах ёсгүй. Шалтгаан нь:
API хүсэлт бүр нууц API түлхүүрээр баталгаажилдаг.
Түлхүүрийг олсон хүн таны нэрийн өмнөөс хязгааргүй хүсэлт илгээж, зардлыг тань өсгөх боломжтой.
Түлхүүр зөвхөн серверийн орчны хувьсагчид хадгалагдаж, гадагш хэзээ ч гарахгүй.
Хүсэлт хүлээн авмагц загвар дөрвөн үндсэн шатыг дамжина.
Оролтын текст эхлээд токен гэх жижиг хэсгүүдэд хуваагдана. Токен нь бүтэн үг, үгийн хэсэг, зай, цэг тэмдэг байж болно.

Токен бүр эмбеддинг буюу тоонуудын урт жагсаалт болж хувирна. Үүнийг тухайн үгийн "тоон тодорхойлолт" гэж төсөөлж болно — утга ойролцоо үгс тоон орон зайд ойролцоо байрлана.
Жишээ нь "квант" гэдэг үг өөрөө олон утгатай: физикийн салангид нэгж, квант механикийн ойлголт, маш жижиг хэмжээ, эсвэл квант тооцоолол. Анхны эмбеддинг нь эдгээр боломжит утгуудыг нэгэн зэрэг агуулж байдаг.

Дараа нь загвар нь эргэн тойрны үгсийн утга, харилцан хамааралд тулгуурлан токен бүрийн эмбеддингийг тодотгон шинэчилнэ. Жишээлбэл, “квант компьютер” гэсэн өгүүлбэрт “квант” гэдэг үгийн тоон дүрслэл нь тухайн контекстийн нөлөөгөөр тооцоолол, технологийн утга руу чиглэнэ. Энэ шат нь загварт үгсийг зөвхөн тус тусад нь боловсруулах бус, өгүүлбэр дэх харилцан хамаарал болон утгын хүрээнд нь боловсруулах боломжийг олгодог.
Контекстжүүлсэн дүрслэлүүдийг ашиглан загвар дараагийн токен ямар байх боломжтойг тооцож, токен бүрийн магадлалыг гаргана. Загвар үргэлж хамгийн өндөр магадлалтай токеныг сонгодоггүй. Харин магадлалын тархалт болон хяналттай санамсаргүй сонголтыг хослуулснаар хариултыг илүү олон янз байдлаар үүсгэдэг.
Сонгогдсон токен нь өмнөх дараалалд нэмэгдэнэ. Үүний дараа шинэчлэгдсэн контекст дээр үндэслэн дараагийн токены магадлалыг дахин тооцно. Энэ үйл явц токен бүрийн хувьд давтагдсаар, эцэст нь бүрэн хариулт үүснэ.
Claude токен бүрийг үүсгэсний дараа хариуг үргэлжлүүлэн үүсгэх эсэхийг шалгана. Дараах нөхцөлүүдийн аль нэг биелсэн тохиолдолд generation зогсоно.
Хэрэглэгчийн заасан гаралтын токены дээд хязгаарт хүрвэл үүсгэлт зогсоно. Энэ тохиолдолд хариу бүрэн дуусаагүй, дундаасаа тасарсан байж болно.
Загвар хариултаа бүрэн дууссан гэж үзвэл өөрөө generation зогсооно.
Хэрэглэгчийн урьдчилан тодорхойлсон зогсоох дарааллын аль нэг нь үүссэн тохиолдолд хариу цааш үргэлжлэхгүй.
Generation дууссаны дараа API нь боловсруулалтын үр дүнг бүтэцтэй хэлбэрээр буцаана. Үүнд үндсэндээ дараах мэдээллүүд багтана:
content: Claude-ийн үүсгэсэн текст болон, шаардлагатай тохиолдолд, хэрэгсэл ашигласан блокуудаас бүрдэнэ.
usage: Оролт болон гаралтад ашигласан токены тоог харуулна. Энэ мэдээллийг зардал тооцох, токены хэрэглээг хянахад ашиглана.
stop_reason: Хариу яагаад зогссоныг тодорхойлно. Жишээлбэл, max_tokens-д хүрсэн эсвэл байгалийн төгсгөлд хүрсэн эсэхийг эндээс мэдэж болно.
Эцэст нь сервер API-ийн хариуг хүлээн авч, шаардлагатай мэдээллийг хэрэглэгч рүү буцаана. Ингэснээр хэрэглэгч Claude-ийн боловсруулсан эцсийн хариуг хүлээн авна.