<?xml version="1.0" encoding="UTF-8"?>
<record
    xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"
    xsi:schemaLocation="http://www.loc.gov/MARC21/slim http://www.loc.gov/standards/marcxml/schema/MARC21slim.xsd"
    xmlns="http://www.loc.gov/MARC21/slim">

  <leader>04409ntm a2200337 i 4500</leader>
  <datafield tag="952" ind1=" " ind2=" ">
    <subfield code="0">0</subfield>
    <subfield code="1">0</subfield>
    <subfield code="2">lcc</subfield>
    <subfield code="4">0</subfield>
    <subfield code="7">1</subfield>
    <subfield code="a">20000</subfield>
    <subfield code="b">20000</subfield>
    <subfield code="d">2024-09-02</subfield>
    <subfield code="l">0</subfield>
    <subfield code="o">FKOM .A23 2024 r Thesis</subfield>
    <subfield code="p">T000003327</subfield>
    <subfield code="r">2024-09-02 00:00:00</subfield>
    <subfield code="w">2024-09-02</subfield>
    <subfield code="y">THESIS</subfield>
  </datafield>
  <datafield tag="952" ind1=" " ind2=" ">
    <subfield code="0">0</subfield>
    <subfield code="1">0</subfield>
    <subfield code="2">lcc</subfield>
    <subfield code="4">0</subfield>
    <subfield code="7">-2</subfield>
    <subfield code="a">20000</subfield>
    <subfield code="b">20000</subfield>
    <subfield code="d">2024-09-02</subfield>
    <subfield code="l">0</subfield>
    <subfield code="o">CD13668</subfield>
    <subfield code="p">T000003328</subfield>
    <subfield code="r">2024-09-02 00:00:00</subfield>
    <subfield code="t">1</subfield>
    <subfield code="w">2024-09-02</subfield>
    <subfield code="y">THESIS</subfield>
  </datafield>
  <datafield tag="999" ind1=" " ind2=" ">
    <subfield code="c">101215</subfield>
    <subfield code="d">101221</subfield>
  </datafield>
  <controlfield tag="003">MY-KuUP</controlfield>
  <controlfield tag="005">20251125110922.0</controlfield>
  <controlfield tag="006">t||||fr|||| 000 0 </controlfield>
  <controlfield tag="007">ta</controlfield>
  <controlfield tag="008">240902s20242024my a|||fr|||| 00| 0 eng d</controlfield>
  <datafield tag="020" ind1=" " ind2=" ">
    <subfield code="a">THE0009940  (Local)</subfield>
    <subfield code="q">Hardback</subfield>
  </datafield>
  <datafield tag="040" ind1=" " ind2=" ">
    <subfield code="a">UMPSA</subfield>
    <subfield code="b">eng</subfield>
    <subfield code="c">UMP</subfield>
    <subfield code="e">rda</subfield>
  </datafield>
  <datafield tag="090" ind1=" " ind2=" ">
    <subfield code="a">FKOM .A23 2024 r Thesis</subfield>
  </datafield>
  <datafield tag="100" ind1="0" ind2=" ">
    <subfield code="a">Abbas Saliimi Lokman,</subfield>
    <subfield code="e">author.</subfield>
  </datafield>
  <datafield tag="245" ind1="1" ind2="0">
    <subfield code="a">Modified word representation vector based scalar weight for contextual text classification /</subfield>
    <subfield code="c">Abbas Saliimi Lokman</subfield>
  </datafield>
  <datafield tag="264" ind1=" " ind2="1">
    <subfield code="a">Kuantan, Pahang :</subfield>
    <subfield code="b">UMPSA,</subfield>
    <subfield code="c">2024</subfield>
  </datafield>
  <datafield tag="264" ind1=" " ind2="4">
    <subfield code="c">&#xA9; 2024</subfield>
  </datafield>
  <datafield tag="300" ind1=" " ind2=" ">
    <subfield code="a">xii, 120 pages :</subfield>
    <subfield code="b">illustration ;</subfield>
    <subfield code="3">0 cm. +30 cm. +</subfield>
    <subfield code="e">1 CD-ROM</subfield>
  </datafield>
  <datafield tag="336" ind1=" " ind2=" ">
    <subfield code="2">rdacontent</subfield>
    <subfield code="a">text</subfield>
  </datafield>
  <datafield tag="337" ind1=" " ind2=" ">
    <subfield code="2">rdamedia</subfield>
    <subfield code="a">unmediated</subfield>
  </datafield>
  <datafield tag="338" ind1=" " ind2=" ">
    <subfield code="2">rdacarrier</subfield>
    <subfield code="a">volume</subfield>
  </datafield>
  <datafield tag="347" ind1=" " ind2=" ">
    <subfield code="2">rda</subfield>
    <subfield code="a">text file</subfield>
    <subfield code="b">PDF</subfield>
  </datafield>
  <datafield tag="500" ind1=" " ind2=" ">
    <subfield code="a">Faculty of Computing</subfield>
  </datafield>
  <datafield tag="502" ind1=" " ind2=" ">
    <subfield code="a">Thesis (Master of Science) -- Universiti Malaysia Pahang &#x2013; 2022</subfield>
  </datafield>
  <datafield tag="504" ind1=" " ind2=" ">
    <subfield code="I">ncludes bibliographical referencesIncludes bibliographical references</subfield>
  </datafield>
  <datafield tag="520" ind1="3" ind2=" ">
    <subfield code="a">This thesis investigates contextual text classification, which is the process of categorising  textual data into different classes or categories based on its meaning within a given  context. Central to this process is the representation of words through vectors for  computational interpretation. Current practices employ Large Language Models (LLMs)  to generate contextualised word representation vectors, achieved through pre-training the  LLM on vast corpora that enables it to grasp intricate language patterns and context. For  contextual text classification, the pre-trained LLM is further train on classificationspecific labeled data in a process called fine-tuning. Although this approach is currently  considered the most optimal in the field, it poses a notable challenge due to the substantial  demand for computing resources stemming from the vast number of trainable parameters  in LLMs. Furthermore, although pre-trained LLMs can generate contextualised word  representation vectors, they lack the flexibility to modify the semantic significance of  these vectors outside of the LLM, necessitating fine-tuning for the modification of word  vectors. To bridge this gap, a five-phase research methodology is structured to propose  and evaluate an algorithm enabling the external modification of LLM-generated word  vectors using scalar values as the focus weightage. To validate this algorithm, the  modified word vectors are compared with original LLM-generated word vectors to  evaluate their reflection of the intended context. In addition, a contextual text  classification experiment is conducted using benchmarked datasets to assess the  performance of the modified word vectors in the targeted classification task. For this  experiment, the modified word vectors serve as input to train a Machine Learning (ML)  model for the text classification process, aiming for the developed ML model to have a  significantly smaller parameter count. This experiment aims to determine the  effectiveness of the modified word vectors in contextual text classification tasks, utilizing  a more computationally efficient approach. Based on the acquired results, the  experiments reveal that the modified word vectors algorithm can effectively alter original  LLM-generated word vectors to reflect intended contexts and can outperform baseline  scores in contextual text classification tasks. Evaluation metrics including Accuracy,  Precision, Recall, and F1 score are employed in the evaluation process, with Accuracy  and F1 score serving as primary metrics. The evaluation showcases significant  improvements, with the test ML model achieving a best accuracy score of 0.571, a 46%  increase from the baseline, and a best F1 score of 0.727, a 30% increment from the  baseline. Overall, this thesis presents five contributions: the proposed modified word  vectors algorithm, the new contextual classification dataset named QCoC, the efficient  question-type classifier based on the feed-forward neural network algorithm, the potential  transferability of the presented work to other domains, and the practical implications of  the presented work towards cases where computational resources are limited or costly.</subfield>
  </datafield>
  <datafield tag="610" ind1="2" ind2="0">
    <subfield code="a">Faculty of Computing</subfield>
    <subfield code="x">Dissertations</subfield>
  </datafield>
  <datafield tag="650" ind1=" " ind2="0">
    <subfield code="a">Universities and colleges</subfield>
    <subfield code="x">Dissertations</subfield>
  </datafield>
  <datafield tag="650" ind1=" " ind2="0">
    <subfield code="a">Theses</subfield>
    <subfield code="x">Dissertations</subfield>
  </datafield>
  <datafield tag="942" ind1=" " ind2=" ">
    <subfield code="2">lcc</subfield>
    <subfield code="c">THESIS</subfield>
  </datafield>
</record>
