考古学者とその副操縦士:Malykhin が Java 1.5 で LLM を disciplina

継続中のトピック : Harness Ops : post-mortems et bench des agents en prod· パート 7/17

クラフト Jul 16, 2026 at 17:457ブックマークに追加

考古学者とその副操縦士:Malykhin が Java 1.5 で LLM を disciplina
イラスト : Léa Fontaine

Nik MalykhinはJava 1.5のベースを最新のハードウェアで動かす必要があった。彼のLLMからの最初の回答はもっともらしく見えたが、リポジトリにうまく適合しなかった。解決策:彼の言葉を鵜呑みにせず、根拠に基づいたアプローチを強制することだった。

簡単に言えば

レガシーコードにLLMを投入すると、正しそうに聞こえるがプロジェクトに合わない回答が生まれる。効果的な方法は、LLMにメモリではなくコード、テスト、成果物といった証拠に基づいて作業させることだ。

考古学者のような作業

2026年7月16日、martinfowler.comにてNik MalykhinはJava 1.5から最新環境へのモダナイゼーションについて語った。特殊な状況下で行われた作業:最新の分析・リファクタリングツールはJava 1.5を好まず、多くは受け付けない。彼の最初の反応は、直接LLMに修正を依頼することだったが、Malykhinが「plausible」と表現する回答は「did not hold up in the codebase」だった。見た目は良いJava 1.5だが、実際のリポジトリには合わない。

転機は方法論にあった。MalykhinはLLMを執筆者ではなく分析者・検証者として使用し、各ステップをリポジトリに根差して行った:既存コードの丁寧な読み込み、テストや実行トレースからの仮説検証、コード自体が示す以上の早急な判断の拒否。記事のメッセージはシンプルだ:レガシーのモダナイゼーションにLLMを使っても、考古学者のように速くは進まないが、証明の穴は少なくなる。

中身の話

このパターンは現代のエージェントツールでは「evidence-first prompting」「grounded reasoning」「retrieval-first」など複数の名前で呼ばれるが、共通するルールがある:アシスタントの各主張はリポジトリの成果物(ファイル、行、テスト)に裏付けられていなければならない。この制約がないと、レガシーにLLMを使った際の最も高くつく「偽陽性」が生まれる:ターゲットバージョンより後のAPI、存在しないメソッド、架空のimportsなどだ。

結論

レガシーコードに取り組むチームにとって、LLM「コパイロット」は執筆に使うのではなく、検索に使うべきだ。真の生産性はLLMに読ませることから生まれ、推測させることではない。CTOにとっての教訓:AI支援によるモダナイゼーションプロジェクトの良い指標は「生成された行数」ではなく「コード自体によって否定された仮説の数」だ。この違いは、レガシープロジェクトが成果を上げるか、再び負債を抱えるかの分かれ目となる。

リソース

本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。

編集部について
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
この記事は役に立ちましたか?

31 人がこの記事を評価しました

いいね
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
シェア:
コメント (7)

ログインして議論に参加しましょう。

Alex 2 17 Jul 2026 · 05:46

Interesting approach. Does this method also work for other legacy systems, or is it specific to Java 1.5?

J.P.R. 2 16 Jul 2026 · 17:46

Est-ce qu'on peut vérifier les suggestions du LLM avant de les implémenter, surtout sur un vieux système comme Java 1.5 ?

Dr. J. 16 Jul 2026 · 17:29

On pourrait tester les propositions du LLM dans un environnement isolé avant de les appliquer au système principal ?

ArtLoverLA 16 Jul 2026 · 13:57

Est-ce que ça marche aussi sur des gros projets Java 1.5 ?

1
CriticAtHeart 16 Jul 2026 · 16:03

Est-ce que ça marche aussi sur des gros projets Java 1.5 ? Les LLM ont du mal avec le code ancien très imbriqué, leurs suggestions sont moins fiables.

BookWorm47 16 Jul 2026 · 13:35

Est-ce que ça marcherait aussi pour d'autres vieux systèmes ?

SkepticSam 16 Jul 2026 · 13:25

Intéressant, mais comment ça se passe avec d'autres langages anciens ?

Alex_LDN 16 Jul 2026 · 13:17

Les LLMs pourraient-ils vraiment sauver nos vieux systèmes ?

トピックの経過

Harness Ops : post-mortems et bench des agents en prod

  1. 1GPT-5.6 へのプロダクションエージェントの移行:2.2倍高速、27%安価 - 真の事後検証13/07/2026
  2. 233k vs 7k トークン:Claude Code と OpenCode のオーバーヘッド比較が明らかにするもの13/07/2026
  3. 3Google Genkit v.Agents : detached turns と human-in-the-loop が preview としてリリース14/07/2026
  4. 4三つのループを纏ったトレンチコート:エージェントの実像14/07/2026
  5. 5「Loop engineering」: 新しい専門分野か、それともcronジョブの再マーケティングか?15/07/2026
  6. 6ベンチマーク Stripe:エージェントは API を接続するが、検証はしない15/07/2026
  7. 7考古学者とその副操縦士:Malykhin が Java 1.5 で LLM を disciplina16/07/2026
  8. 8QCon AI Boston : 「プロンプト → プラットフォーム、ハーネス、評価」 - 実践が理論を裏付ける17/07/2026
  9. 9grepを超えて:文脈豊かなAIコーディングハーネスの理論20/07/2026
  10. 10InAgentがOSWorldで90.2%を達成:コンピューター使用エージェントのギャップが中国スタックで縮小03/08/2026
  11. 11Wallfacer: ターミナルセッションマネージャー。Claude Code およびマルチエージェントワークフロー向けに設計。06/08/2026
  12. 12Claude Code インターセッションメッセージングが提供開始 - エージェント間調整に初のネイティブプリミティブが追加08/08/2026
  13. 13AIエージェントのスキルは標準化されつつある:CodexとVS Codeは対応済み、Claudeはまだ未対応10/08/2026
  14. 14AIエージェントは嘘をつき、不正を働き、盗みをはたらく――そしてそのことが、あらゆるベンチマークが測れる以上に、普及の足かせとなっている。13/08/2026
  15. 15# コンテキストエンジニアリング: なぜ300の適切に選ばれたトークンが10万のノイズの多いトークンに勝るのか14/08/2026
  16. 16OneCLI (YC S26) は OSS のサンドボックス化されたエージェントハーネスをリリースしました。Claude Code に対するチーム規模の回答です。19/08/2026
  17. 17カーソル起点とエージェントバージョン管理の問題: Gitがそもそもこれに対応するようには設計されていない理由25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
テーマ
探索
インフォメーション