LoRAによる大規模言語モデルのファインチューニング

ChatGPTをはじめとする大規模言語モデル(LLM)は、その高度な言語処理能力で注目を集めています。しかし、LLMベンダーが提供するモデルを利用する場合、利用料金の問題や、機密情報を含むデータの外部への漏洩リスクが懸念 […]

深層学習モデルの軽量化: PyTorchによる知識蒸留の実践

近年、ディープラーニングは画像認識、自然言語処理など、様々な分野で目覚ましい成果を上げています。特に、大規模なニューラルネットワークは、大量のデータを学習し、高度なタスクをこなす能力を持っています。しかし、これらのモデル […]

Pythonで始める因果推論入門

昨今、ビジネスでは、データに基づいた意思決定がますます求められています。しかし、データから得られるのは、あくまで相関関係です。因果関係を正しく理解することで、我々はより確実な予測を行い、効果的な対策を立てることができるよ […]

【LLM活用】LangChainとLLMLinguaでプロンプト圧縮

近年、ChatGPTをはじめとする大規模言語モデル(LLM)が、私たちの生活に大きな変化をもたらしています。これらのモデルは、膨大な量のテキストデータを学習することで、人間と自然な対話をしたり、文章を生成したりすることが […]

LitServe: 機械学習モデルの効率的なデプロイ

機械学習モデルは、FlaskやFlastAPIなどのWebフレームワークを使用して、WebAPIとしてデプロイされることが一般的です。これらのフレームワークは、WebAPIを構築するための便利な機能が豊富に含まれています […]

PySR: シンボリック回帰とは何か?

シンボリック回帰(Symbolic Regression、記号回帰とも呼ばれます)は、データを説明する数式を自動的に見つけ出す機械学習手法です。この手法では、関数の形式を事前に決めることなく、与えられたデータに最も合う数 […]

Pythonによる粒子群最適化

数理最適化を応用した最適化問題の解決には、微分不可能な関数にも対応可能なメタヒューリスティック手法が広く利用されています。その中でも、生物の群れ行動を模倣した群知能は、複雑な問題に対して高い適応性を示します。今回は、代表 […]

クラス不均衡データにおける機械学習モデルの構築

クラス不均衡データとは、あるクラスのデータが圧倒的に多く、他のクラスのデータが非常に少ない状態のデータセットを指します。このようなデータで機械学習モデルを構築すると、多数派クラスに偏った予測をしてしまい、少数派クラスの予 […]