Саймон Уиллисон пишет в блоге. Он советует копить вещи, которые умеешь делать. Это помогает строить программное обеспечение.
Важно понимать, что возможно. Нужно знать, как это сделать. Ответы бывают простыми или очень сложными.
Можно ли запустить распознавание текста прямо в браузере? Обработать огромный файл в Python? Чем больше ответов у вас есть, тем лучше.
Знать теорию — это не то же самое. Нужно видеть работающий код. Это ключевой актив любого профессионала.
Уиллисон собирает решения разными способами. Он ведёт блог и записную книжку. У него больше тысячи репозиториев на GitHub.
Многие проекты — это небольшие прототипы. Они доказывают какую-то одну идею. Это код, который можно потрогать.
Сейчас он использует большие языковые модели. Они помогают расширять коллекцию. На сайте tools.simonwillison.net собраны инструменты.
Это HTML-страницы с JavaScript и CSS. Каждая решает одну конкретную задачу. Просто и понятно.
Зачем всё это копить? Это развивает ваши способности. А ещё это мощный инструмент для работы с ИИ-агентами.
Уиллисон любит одну схему. Он просит агента создать что-то новое. Для этого нужно скомбинировать два старых рабочих примера.
Первый инструмент в его коллекции — распознавание текста из PDF. Работает прямо в браузере. Не нужно ничего устанавливать.
Раньше он экспериментировал с библиотекой Tesseract.js. Она умеет распознавать текст на картинках. Всё работает на WebAssembly.
Но ему нужны были PDF-файлы. Тогда он вспомнил про библиотеку PDF.js. Она умеет превращать страницы PDF в изображения.
У него уже были куски кода для обеих библиотек. Он соединил их в одном промпте. И отдал языковой модели.
Модель поняла задачу. Она создала работающий инструмент. Теперь можно загрузить PDF и получить текст.
Вот и весь секрет. Копите свои находки. Записывайте их. Потом вы сможете собрать из них что-то новое.