Дорвеи Парсинг текста под Пандору

Amiramus

Премиум
Регистрация
5 Мар 2017
Сообщения
17
Реакции
9
И снова привет всем.
Как лучше парсить тексты под дорген Пандора: в один файл или раскидать по разным файлам (каждый тхт с текстами релевантными каждому конкретному ключу?
Или в принципе пофиг?
 

Amiramus, чем парсишь отдельный парсер или контентбокс под Пандору?
но в том и другом случае парси в разные файлы, так как сам Топпер даже отписывал что если всё в один файл, это не есть гуд ты будешь иметь потери в скорости - контентбокс парсит в многопоток - 25 потоков и вот смотри все в один файл создается очередь записи, ведь файл один, а если ты сразу в 25 файлов параллельно, то тут только будет зависеть от скорости твоего жесткого диска, поэтому и появилась даже 64 битная Пандора, чтоб задействовать всю доступную память ОС
 

Amiramus, чем парсишь отдельный парсер или контентбокс под Пандору?
но в том и другом случае парси в разные файлы, так как сам Топпер даже отписывал что если всё в один файл, это не есть гуд ты будешь иметь потери в скорости - контентбокс парсит в многопоток - 25 потоков и вот смотри все в один файл создается очередь записи, ведь файл один, а если ты сразу в 25 файлов параллельно, то тут только будет зависеть от скорости твоего жесткого диска, поэтому и появилась даже 64 битная Пандора, чтоб задействовать всю доступную память ОС
X-parser
Спасибо за ответ.
А сколько статей на один ключ парсить? 3 норм? Или чем больше тем лучше
 

Рекламное сообщение

⚡Создайте любое изображение, которое можете вообразить с помощью нейросети Fooocus & Stable Diffusion.

За 2 месяца вы научитесь с помощью нейросети Fooocus и передовых моделей SDXL от Stable Diffusion создавать визуальные работы, которые будут выделяться в лентах социальных медиа и придадут уникальность вашим проектам. Вы начнете свой путь именно с изучения нейросети Fooocus, где мы расскажем все о генерации крутых изображений. Затем перейдем к архитектуре, музыке, видео и многому другому. Все будет происходить постепенно. И все это под руководством куратора Ильи Тимонина и его команды!

➡️➡️➡️ Подробнее о клубе
 

А сколько статей на один ключ парсить? 3 норм? Или чем больше тем лучше

вообще ваш первоначальный вопрос был в том что один текстовик на один какой то ключ, а теперь почему то вы решили по одному ключу парсить нн-ое количество статей. это вот и не то к чему надо стремиться, я делаю парсинг скрапбоксом там по умолчанию каждый ключ - свой текстовый файл и всё, пусть там нет логической последовательности, но это же вы делаете под доры и при генерации пандорой вновь будет задействован рандом, так что в итоге лишние манипуляции и не более
 


Обратите внимание

Назад
Сверху