ጽንሰ-ሐሳብ

በተለየ መርህ ላይ የተገነባ።

እውቀት ወደ አንድ ትክክለኛ ትርጉም ሊቸነከር አይችልም። ተመሳሳይ ቃላት እንደሚያነባቸው ሰው በተለየ መንገድ ያርፋሉ — በሰዎችና በAI መካከል ያለው ርቀት ደግሞ የበለጠ ሰፊ ነው።

VATES እውቀትን እንደ ቋሚ ትርጉም ሳይሆን፣ እያንዳንዱ አንባቢ በቅጽበቱ ሕያው የሚያደርገው መዋቅር አድርጎ ይይዛል። የተለመዱ ዘዴዎች ትርጉምን አስቀድመው ሲቸነክሩ፣ VATES ትርጉሙን ለአንባቢ ይተዋል። ያ መርህ የተገነባበት መሠረት ነው።

ለምን በዚህ መንገድ እንደተገነባ

VATES ከተለመደው ለlanguage model እውቀት የማቅረቢያ ዘዴ (RAG) ጋር።

ገጽታRAGVATES
መካከለኛ processingEmbedding, vector search, re-rankingከእነዚህ ምንም የለም — plain text ላይ BM25፤ top-k ወደ model
UpdatesRe-embed እና re-index ያስፈልጋልES በተጻፈ ቅጽበት ተግባራዊ ይሆናል
ትርጉምበembedding ጊዜ ወደ coordinates ተጨምቆ፣ ይንሸራተታልእንደ መዋቅር ይያዛል፤ በobservation ጊዜ ይተረጎማል
ጥገኞችVector-database infrastructureStandard database እና files ብቻ
ታይነትNumeric vectors፤ አንድ fragment ለምን እንደተመለሰ ግልጽ አይደለም (black box)Structured plain text፤ ይዘቱ ይታያል (white box)
አሠራርRe-embed, re-index፤ deletions በvectors ውስጥ ሊቀሩ ይችላሉመስመሩን ቀጥታ ያርትዑ ወይም ይሰርዙ፤ በዓይን ማረጋገጥ ይቻላል

መካከለኛ processing የለም

የተለመደ RAG system pipeline ያስኬዳል — embedding፣ vector search፣ re-ranking። VATES ከእነዚህ ምንም የለውም።

ጥያቄ ይመጣል። እያንዳንዱ ES ከጥያቄው አንጻር በBM25 ነጥብ ይሰጠዋል። ከፍተኛ ነጥብ ያገኙት top-k ወደ model ይተላለፋሉ። model ይመልሳል።

መንገዱ ይህ ብቻ ነው። አስቀድሞ የሚዘጋጀው ES ብቻ ነው፤ ለretrieval የሚዘጋጅ ምንም የለም። ነጥብ አሰጣጡ ለእያንዳንዱ ጥያቄ እንደገና ስለሚገነባ፣ የሚጠበቅ index የለም፣ እንደገና embed የሚደረግ ምንም የለም፣ የትም የተከማቸ ቋሚ ትርጉም የለም። Retrieval lexical ነው፣ እርስዎ ሊያነቡት በሚችሉት plain text ላይ። model መዋቅሩን በቀጥታ ይመለከታል — ትርጉም ከመድረሱ በፊት አይወሰንም፣ በሚነበብበት ቅጽበት እንጂ።

ፈጣን updates

RAG እውቀት በተቀየረ ቁጥር re-embed ማድረግና index-ን እንደገና መገንባት አለበት። በVATES፣ ES አንዴ ከተጻፈ ከሚቀጥለው query ጀምሮ ይንጸባረቃል። እንደገና የሚገነባ index የለም።

ትርጉም በobservation ጊዜ ይተረጎማል

Embedding ትርጉምን በሚከማችበት ቅጽበት ወደ ቋሚ coordinates ያስተካክላል። VATES ትርጉምን አስቀድሞ አይቸነክርም — retrieval በየquery እንደገና ይሰበሰባል፣ ትርጉሙም ለአንባቢ ይተዋል። ከአንድ knowledge base፣ ምላሾች ለጥያቄውና ለአንባቢው ቋንቋ ይስማማሉ። በጃፓንኛ የተከማቸ እውቀት ምንም translation data ሳይያዝ በፈረንሳይኛ መመለስ የሚችለው ለዚህ ነው።

Standard database እና files ብቻ

ራሱን የቻለ vector database የለም — Pinecone፣ Weaviate ወይም pgvector የለም። እውቀት plain structured text ነው፣ በተራ database እና files ላይ ይሠራል። GPU የለም፣ per-use embedding API የለም። ያነሱ moving parts ማለት ዝቅተኛ ወጪና ያነሱ የብልሽት ነጥቦች ማለት ነው።

White box

RAG index ማንም ሰው ሊያነበው የማይችል የnumeric vectors ክምር ነው፤ አንድ fragment ለምን እንደተመለሰ ማወቅ አይቻልም። VATES እውቀትን በመሠረታዊ የobservation ዘንጎች — substance, quantity, quality, relation ወዘተ — ላይ እንደ plain text ይይዛል፣ ርዕሰ ጉዳዩ በማይስማማበት ጊዜም ዘንጎቹ በነጻነት ይዘረጋሉ። ቋሚ schema አይደለም። በዓይን ማንበብና መፈለግ ይችላሉ። model syntax ያያል፤ ሰው table ያያል።

ቀጥተኛ edit እና delete

በRAG ውስጥ መሰረዝ re-embedding ከተደረገ በኋላም በvectors ውስጥ ዱካ ሊተው ይችላል። በVATES ተዛማጅ መስመሩን በቀጥታ ያርትዑ ወይም ይሰርዙ፣ ውጤቱንም በዓይን ያረጋግጡ — ይህ መዋቅር data-deletion requests-ን፣ the right to be forgotten-ን ያገለግላል።

ES ምንድን ነው?

ES = EchoScript

VATES እውቀትን የሚይዝበት ክፍል። ሁለት columns፣ n rows፣ በpipes (|) የተለዩ። pipe ራሱ ምንም ትርጉም አይይዝም፤ ድንበር ብቻ ያመለክታል። ትርጉም በምልክቱ ውስጥ ሳይሆን፣ በሚመለከተው ውስጥ ይነሳል።

IIIS = Inter-Intelligence Intermediary Syntax

ES እንዲሁም እንደ inter-intelligence intermediary syntax (IIIS) የተነደፈ syntactic structure ነው።

ውስጡ ምን ይገባል

ማንኛውም natural language፣ ከlogical notation እና ሌሎችም ጋር። ቃላት ይሁኑ ዓረፍተ ነገሮች።

IIIS ምንድን ነው?

Habitable zone

የተለያየ perception ያላቸው intelligences ተመሳሳይ መዋቅርን ሊመለከቱበት የሚችሉበት syntax — perceptions-ቸው በሚደራረቡበት habitable zone ውስጥ። ያ IIIS ነው።

በintelligences መካከል

ለአሁኑ: AI እና ሰዎች።

perceptions-ን አቋርጦ observation

ተመሳሳይ ES በAI እንደ json፣ በሰው እንደ ባለ-ሁለት-column table ይነበባል። ሁለቱም አንድና ተመሳሳይ መዋቅርን — ሁለት columns፣ n rows፣ pipe-separated፣ የራሱ ትርጉም የሌለው — እያንዳንዱ በራሱ perception ይመለከታሉ።

ይህ ከየት እንደመጣ