画像・音声・言語。モデルを訓練し、プロダクトにして、現場に届けるところまで。医療は、いちばん深い応用先。


音響モデルからボコーダまでゼロから設計・学習。国内でも数社しか手がけない領域を、4人チームのメイン開発者として主導。

院内に置く医療LLM。退院サマリー自動生成・AI音声カルテ・紹介状OCR。患者データを院外に出さない。

専門用語に強い音声認識。「閉鎖コーヘルニア」を「閉鎖孔ヘルニア」に直すAI後処理つき。

日中英対応・115Mパラメータの漫画OCR。A100一枚・3日の学習で、蒸留元の教師モデルを全指標で超えた。


画像を最大90%軽くする買い切りアプリ。PNG・PDF圧縮をRustで自前実装して商用ツール超え。

AIで書いた日本語を、人間の文章に戻すClaude Skill。「AI臭の正体は書き手の不在」という分析ごと。

医療ガイドライン約200冊・2010〜2024年の改訂をたどり、旧版と新版で答えがどう変わったかを、新旧の出典つきで収録したデータセット。ライブデモで実例を見られる。
第116回国試合格。研修医として大分・別府の病院へ。秋にStable Diffusionと出会う。
自作の画像生成モデルが話題に。研修を離れ、AIエンジニアに転身。
Livetoon取締役CTO。フルスクラッチ日本語TTSを主導。東大病院と兼務。
NVIDIA主催ウェビナー登壇。中日新聞に「医師からAIエンジニアに」。
GENSHI AI設立・CEO就任。AMED採択。医療AIを現場に実装中。