posts

archiveJをオープンします

archiveJをオープンします(open beta) 長時間かかる資料整理と写真整理への対応 白書を編集するとき最も時間がかかる作業は、無数の資料を人が読み、これを再編集し、上位政策決定者との対話を通じた方向設定です。同様にデジタルアーカイブを開発するとき最も気になる部分は資料整理と資料をベースにしたさまざまなコンテンツの生成問題です。直接開発したarchiveJはそのフォルダにアクセスして、無料に近いAI LLM AGENT(無料に近い人工知能エージェント)をつけて、関連 …

2026-06-01 TCG
archiveJをオープンします document 1

archiveJをオープンします(open beta)

長時間かかる資料整理と写真整理への対応

白書を編集するとき最も時間がかかる作業は、無数の資料を人が読み、これを再編集し、上位政策決定者との対話を通じた方向設定です。同様にデジタルアーカイブを開発するとき最も気になる部分は資料整理と資料をベースにしたさまざまなコンテンツの生成問題です。直接開発したarchiveJはそのフォルダにアクセスして、無料に近いAI LLM AGENT(無料に近い人工知能エージェント)をつけて、関連作業を進めます。

確かにLLMを使うので、それなりにトークンが多く入って高くならないでしょうか?

はい、コードや関連処理方式を知らずに最適化せず、広範な編集を任せれば、無駄な仕事をしながら任せていない仕事をしてトークンを消費します。しかし、私たちが管理するデジタルアーカイブや白書の資料は量が決まっていて、人間もできなかったことですからね。予算を持った組織や上位機関だけができた領域に労働者(Agent)をつけて、個人研究者も前に進める方法を用意しました。

1)記録を整理するエージェント作業

(オーディオ)インタビューした内容の口述記口述記録ファイル(転写)を置いておくと、自動的に文脈を確認。 (写真)写真に対する説明を付け、文脈を把握。 (PDF、ハングル、txt)読める形式に文書を変換し、以前作った事業と文書を読む。 (ビデオ)ビデオ内容を把握し、内部に出るオーディオや内容を把握。 (オーディオがないビデオ)転写をしない場合、ビデオ内容について把握し説明。(footage) (リンク、サイト)そのサイトをキャプチャし、どんな内容か読んで説明。

2)記録をベースに新しいコンテンツを作るエージェント作業

(一般人)デジタルアーカイブを通じて組織が年度別に進行した仕事を把握する探索/検索提供 (研究者)関連資料の深いところまで読めるように研究者のためのリサーチガイド発行 (研究者)関連内容を交叉比較して論文に使える基礎資料提供 (コンテンツ)生成された内容をベースにブログコンテンツ発行 (コンテンツ)組織が望む方向にさまざまなメディアを組み合わせて主題と意図のある展示発行 (コンテンツ)発行されたキーワードをベースに多数のコレクション発行

3)翻訳作業と多言語化

(翻訳)そのシステムを通じて2〜3時間程度の作業と翻訳で1000ページ程度の分量の翻訳をさっとやります。これは単純な文書翻訳ではなく、そのアイテムの基本情報、収集されたキーワード、関連する言語別ページ、生成されたコンテンツすべてを含みます。 (翻訳とウェブサイト)1万個のアイテムがアーカイブされている場合、その言語別に1万個のアイテムをすべて言語別にサービスできます。 (翻訳)Google翻訳や直接翻訳を含めて、私たちは関連する価値を複数の言語により簡単に発行できます。

4)進行作業と限界

(改善)関連する指示とミッション、資料に対する文脈をアーカイブの所有者と開発チームが一緒に話し合い整理し、これをAI Agentが参考にします。 (限界)AI Agentはすべてを完璧にこなしません。関連する絶え間ない時間と努力を費やすとき、正確なガイドとミッションを設定し、よく遂行できるように人が助けます。 (拡張)拡張されるほど研究者とお客様はより多くのアーカイブを作りたがるでしょう。しかし、内容に対する精錬とガイドはより多くの時間を費やすことになります。 (お客様)お客様と正しいアーカイブと過程が生まれるように、ゆっくり、熱心に作業します。

2026年6月13日 TCG

キーワード
多言語翻訳を見る