📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Claude Skills - SOPs For Agents

Sam Witteveen13:21

Transcription

Хорошо. Итак, если вы строите бизнес любого рода, где вы занимаетесь каким-либо производством или предоставляете услуги, одно из того, что вы довольно быстро усваиваете, это то, что вам нужно разработать набор стандартных операционных процедур. По сути, это как список того, что нужно сделать, в каком порядке и с каким качеством. В мои 20 лет я построил компанию, которая занималась производством CD, CDR и DVDR. И у нас был целый набор различных СОП для всего, от дизайна упаковки до требований, которые мы предъявляли фабрике при производстве. И даже такие вещи, как картонные коробки, в которых мы отправляли всю продукцию, должны были быть изготовлены на заказ, чтобы на них был наш логотип и тому подобное. Хорошей стороной было то, что как только у нас появились СОП, стало очень легко просто размещать заказы и заставлять все это работать само по себе.

Теперь в этом видео я хочу поговорить о том, как некоторые крупные компании теперь заставляют агентов принимать стандартные операционные процедуры для различных задач. Мы видим это в ряде различных мест в данный момент. Главное, о чем я собираюсь говорить в этом видео, это то, что Anthropic только что анонсировал под названием "навыки" (skills). Но я также коснусь плагинов Claude Code и расширений Gemini CLI. Во многих отношениях все эти три вещи являются способами предоставления вашим агентам набора стандартных операционных процедур, которым они могут следовать для выполнения различных задач, которые вы хотите, чтобы они выполняли.

Итак, я думаю, что в данный момент не является сюрпризом, что качество ваших агентов и качество вашего вывода из любой LLM будет зависеть от контекста, который вы в них вкладываете. Верно? Многие люди говорили о инженерии контекста, и на самом деле это уходит корнями на несколько лет назад, верно? Эти модели по сути делают условную вероятность, где они обусловливаются всем, что вы в них вкладываете. Поэтому, чем лучше качество контекста, который вы вводите в LLM или в вашего агента, тем лучшее качество вы фактически получите. Так же, как людям нужны СОП для уменьшения вариативности, агентам они нужны еще больше. И вы можете рассматривать это как своего рода основной шаблон, где у вас есть входные данные, проходящие через ряд шагов, имеющие ключевые точки принятия решений, использующие инструменты, имеющие какой-то вывод, а затем, возможно, даже имеющие проверку в конце, чтобы убедиться, что вывод действительно соответствует тому, что должно было быть произведено.

Итак, если мы перейдем к анонсу Anthropic, они говорят здесь о навыках Claude. И интересно, что это не только для онлайн-интерфейса чата Claude. Это также то, что вы можете использовать с API. Так что это действительно показывает, что они видят, что это своего рода ключевая фундаментальная вещь для людей, создающих лучшие агенты и лучшие рабочие процессы для использования моделей Anthropic.

Итак, что же такое навык здесь? Навыки — это папки, которые включают инструкции, скрипты и ресурсы, которые Claude может загружать при необходимости. Claude будет получать доступ к навыку только тогда, когда он будет релевантен. Теперь они создали ряд готовых навыков для таких вещей, как работа с файлами Excel, создание презентаций, форматирование документов и тому подобное. И если вы подумаете об этом, вы можете рассматривать это как часть исходной спецификации MCP. Большинство людей фокусируются на MCP исключительно как на вызовах API или приеме данных, но есть третья вещь для контекста, своего рода подсказок и возможности доступа и извлечения подсказок для включения в контекст модели. Во многих отношениях вы можете рассматривать это как создание нового способа выполнения такого рода задач.

Хорошо, так они говорят о том, как работают навыки, что, по сути, он будет сканировать любые релевантные совпадения. Теперь они не говорят нам, как они это делают, делается ли это с помощью какого-то сравнения сходства между тем, что вы вводите, и тем, как называются ваши навыки, и т. д. Но они говорят нам, что навыки являются компонуемыми, что они могут складываться вместе, что они переносимы, так что как только вы их получите, вы можете использовать их не только в приложениях Claude, но и в Claude Code, вы можете использовать их с API. И очевидно, что они приложили некоторые усилия к тому, как Claude будет решать, какой навык использовать, говоря, что они загружаются только тогда, когда они действительно нужны.

Так что, если вы зайдете в настройки Claude, вы можете перейти к возможностям, и у них есть ряд готовых. И один из них — это создатель навыков. Так что это довольно круто, что у них есть навык, который фактически помогает вам создавать навыки. И поэтому создатель навыков, его работа заключается в том, чтобы помочь вам предоставить интерактивное руководство для разработки рабочего процесса, разработки чего-либо, а затем он определит структуру папок и создаст то, что они называют файлом skill.md. Так что это будет одна из ключевых вещей, которая будет определять фактические шаги, синтаксис, как он будет использовать любые инструменты. И во многих отношениях это похоже на то, что мы видели в программировании довольно долгое время, верно? У нас были такие вещи, как агенты. Cursor имел свои собственные пользовательские инструкции. Практически каждый агент программирования теперь имеет способ предварительной загрузки в него множества пользовательских инструкций. Так что круто то, что этот навык фактически поможет вам создавать больше навыков. Но тем не менее, вы можете пройти через это и сделать это самостоятельно.

Итак, как я упоминал ранее, одна из других действительно интересных вещей в этом заключается в том, что это не только для их интерфейса чата Claude. Это также будет доступно в API. Так что они говорят, что агентские навыки, которые мы часто называем просто навыками, теперь могут быть добавлены к запросам API сообщений, и у них есть целый конечный пункт для этого, а также инструмент выполнения кода на бэкэнде, чтобы иметь возможность использовать их. И с такими вещами, как эти, мы начинаем видеть довольно большое расхождение между API различных поставщиков LLM. Итак, у нас есть все основные поставщики базовых моделей, которые фактически обновляют работу своих API, чтобы лучше работать с их фоновыми инструментами и инструментами, которые они добавляют к API, которые они будут запускать сами. Например, API Gemini имеет Google Поиск и т. д.

Таким образом, помимо того, что они говорят об этом для потребительских продуктов, они также изложили, как это может быть использовано для агентов. И вы можете видеть здесь всю эту идею конфигурации агента, где он будет иметь навыки, оснащенные для различных вещей, и он будет иметь различные MCP, к которым он может подключаться. И вы можете видеть здесь, что он использует выполнение кода на бэкэнде для доступа к различным папкам в этом каталоге навыков для таких вещей, как форматирование документов определенным образом, работа с PDF-файлами, использование базы данных, такой как BigQuery, и т. д.

И когда мы смотрим на это, есть больше деталей об анатомии навыка и файле skill.md, который будет иметь название, описание, и вы можете видеть во многих отношениях элементы, похожие на весь слой подсказок MCP. У них есть несколько хороших примеров здесь некоторых различных навыков, как вы можете делать такие вещи, как объединение дополнительного контента, который может использоваться и загружаться только тогда, когда он нужен, и даже показывая вам, как эти вещи фактически используются в фактическом контекстном окне при сочетании с такими вещами, как инструменты и другие MCP и т. д.

Во многих отношениях это также похоже на то, что они делают с плагинами Claude Code, и на то, что Google делает с расширениями Gemini CLI. Вы хотите упаковать вещи как эти своего рода навыки. Теперь, для инструментов CLI Code, это будет включать такие вещи, как под-агенты, команды, MCP-серверы, и это, вероятно, гораздо более детально и интенсивно, но в основе своей это все еще та же идея получения лучшего контекста в фактическую модель, когда вам это нужно, чтобы иметь возможность производить желаемый вывод.

Так что интересно видеть, как мы движемся вперед с этим, вся идея маркетплейсов плагинов, или вы могли бы почти думать о них как о маркетплейсах контекстных окон, где люди могут создавать множество различных вещей, которые вы можете упаковать и предлагать. И это также развивает идею о том, где эти чат-платформы, такие как ваш чат Claude, ваш чат Gemini, ваш ChatGPT и т. д., становятся полноценными платформами, которые могут размещать приложения и выполнять множество различных агентских задач для вас. Мы видели это как часть анонса, который OpenAI представила недавно на своем дне разработчика для приложений.

И одна вещь, которую стоит отметить здесь, это то, что это не только одна из компаний, производящих базовые модели, делает это. Они все садятся на этот поезд. Вы склонны видеть, что OpenAI, Google и Anthropic движутся в одном направлении. А затем другие поставщики, такие как Mistral и, возможно, некоторые китайские компании, быстро следуют, интегрируя многие из этих идей в свои платформы.

Итак, чтобы закончить, я бы сказал, зайдите и проверьте навыки Claude, и если у вас есть к ним доступ, зайдите в чат Claude и попробуйте заставить его что-нибудь создать. Как вы можете видеть здесь, я просто говорю: "Хорошо, возьми мои транскрипты YouTube и преврати их в контент для LinkedIn". Он проведет вас через ряд различных шагов, прежде чем прийти к окончательному выводу. И вы можете видеть, интересно, что он, очевидно, знает, что у меня подключено, что у меня подключен Notion. Так что вам придется исправить его и направить его так, как вы хотите. Но круто то, что вы затем можете взять этот навык и использовать свои собственные пользовательские подсказки. Вы можете делать множество различных вещей, чтобы создавать свои собственные стандартные операционные процедуры для использования этих платформ. Платформа больше не просто чат-приложение. Это действительно набор личных агентов, которыми вы можете пользоваться.

Хорошо. Итак, после того, как я записал видео, я нашел здесь еще несколько действительно интересных вещей. Первая — это лучшие практики. Если вы глубоко погрузитесь в это, вы увидите много интересного о сохранении токенов. У них есть пример, как извлечь PDF, используя примерно 50 токенов, и они говорят об использовании этого вместо чего-то слишком многословного. Мне также интересно, что если вы знаете, как писать код, возможно, написание кода для вставки этих вещей или при создании навыка для создания навыков, вставка кода в это фактически работает лучше, чем просто написание простого английского.

Другая действительно увлекательная вещь заключается в том, что у них теперь есть этот репозиторий навыков, и там есть множество различных навыков, которые они сделали сами. Так что вы можете увидеть здесь их создатель навыков. Мы можем увидеть skill.md, говорящий о том, как он делает все, каков процесс, и мы видим, что он довольно длинный. И мы видим, что у них есть код Python для упаковки этого, для проверки этого и т. д.

Другая вещь, которая показалась мне действительно интересной, — это лицензия. Для некоторых из них вы увидите, что они имеют лицензию Apache 2, что я и ожидал. Но если мы зайдем и посмотрим на некоторые другие, например, в навыках работы с документами, файлами Excel, мы увидим, что это не лицензия Apache. Это строго авторское право Anthropic, и все права защищены. Похоже, они ставят флаг, что не хотят, чтобы другие поставщики копировали это и вставляли в свои собственные версии. Но если вы хотите разобраться в этом, этот репозиторий определенно стоит изучить, чтобы увидеть, как они делают множество различных вещей, таких как рекомендации по бренду, множество вещей, связанных с документами, построителями MCP, создателями навыков и т. д.

Мое предположение заключается в том, что в будущем у нас будут репозитории потрясающих навыков. Это то, что вы можете себе представить, что мы начнем видеть довольно быстро, когда люди начнут выкладывать такого рода вещи. В любом случае, дайте мне знать в комментариях, для чего вы могли бы использовать это самое необычное. Есть ли у вас стандартные операционные процедуры или вещи, которые, возможно, не очевидны? Мне кажется, мы видели перепрофилирование контента или написание твитов, но мое предположение заключается в том, что, вероятно, есть много действительно крутых вещей, которые делают люди, и которые не очевидны. И я бы также сказал, что если вы хотите защитить свои навыки, вы можете рассмотреть возможность отключения разрешения Anthropic на обучение на этих навыках. Я уверен, что частью их целей по улучшению моделей Claude является получение как можно большего количества навыков, чтобы они могли понять, на чем им нужно обучать модели.

Итак, дайте мне знать, какие необычные СОП или необычные вещи вы делаете с этими платформенными агентами и куда бы вы хотели, чтобы это развивалось в будущем. В любом случае, и, как всегда, если вы хотите видеть больше таких видео, пожалуйста, нажмите "Нравится" и подпишитесь. Я увидимся в следующем видео. Пока.