Новости Joomla

Компонент Joomla 6: Генератор LLMs.txt.

Компонент Joomla 6: Генератор LLMs.txt.

Компонент Joomla 6: Генератор LLMs.txt.

Ещё один генератор ИИ-файлов llms.txt и llms-full.txt.

Основные особенности/возможности компонента:

  • Генерация по стандарту: Автоматическое создание файла-визитки llms.txt и расширенной версии llms-full.txt с аннотированным списком материалов.
  • Интеллектуальная работа с контентом: Компонент использует мета-описания (Meta Description) из статей и пунктов меню, превращая SEO-настройки сайта в качественный контекст для нейросетей.
  • Просмотреть результат генерации файлов можно сразу в рабочей области компонента. После внесения корректив (через Настройки компонента. При отладке лучше открыть три вкладки в браузере: Настройка — Геренация/Превью — Список Материалов/Категории/Меню.) — проводим перегенерацию, смотрим результат до полной «победы».
  • Автоматизация и безопасность: Синхронизация с sitemap.xml, группировка по категориям и автоматическое создание резервных копий (.bak) при каждой генерации.
  • Гибкое управление: Возможность исключения определенных категорий и/или статей и/или пунктов меню, а также простая настройка через стандартную админпанель Joomla.
  • Подробное руководство/справка: Пошаговая инструкция для пользователя в Настройках компонента для редакторов с базовым знанием администрирования Joomla.

👉 Важно учесть.
1️⃣ Компонент Генератор LLMs.txt изначально составляет базовый список ссылок на основе sitemap.xml и сверяется с ним на предмет: запрета индексации url в robots.txt, тегов noinex/nofollow. Это экономит время на проверку «закрыть от индексации», поскольку компонент генерации Sitemap.xml уже реализовал эту задачу. Посему, формирование ссылок для ИИ имеет комплексный подход, составление грамотного/валидного/релевантного sitemap.xml никто не отменял.

2️⃣ Тексты-описания ссылок формируются из Meta Description com_content (только компонент Материалы) и выбранных пользователем Меню сайта. Важно, чтобы Meta Description были уникальными и релевантными, соответствовали базовому seo. Составленные «на отшибись» Description для ИИ — «не катит» (впрочем, для поисковых систем они тоже «не канали»).

Разработчик - участник нашего сообщества Александр Кузнецов (@newvksan).

Страница расширения

@joomlafeed

#joomla #ии #ai

👩‍💻 WT LLMs для Joomla: llms.txt, llms.json для AI-агентов.

👩‍💻 WT LLMs для Joomla: llms.txt, llms.json для AI-агентов.

Это Joomla-компонент для публикации AI-ready карты сайта и автоматической генерации файлов llms.txt, llms-full.txt и llms.json по концепции llmstxt.org.  Также о концепции llms.txt говорит Google в своей справке Lighthouse. Решение помогает LLM-моделям, AI-агентам, GEO/AI SEO-процессам и внутренним автоматизациям получать структурированные данные о сайте без ручной сборки JSON и Markdown.

С помощью WT LLMs можно:
- создать структурированное описание сайта для AI-агентов;
- управлять профилем сайта, картой интентов и каноническими страницами для этих интентов из админки Joomla;
- генерировать llms.txt и llms.json;
- использовать REST API для автоматического заполнения данных;
- отдавать публичную schema-инструкцию для AI-агентов;

В комплект компонента входит плагин markdown-версии страниц Joomla. Системный плагин Joomla, который добавляет альтернативное Markdown-представление страниц сайта. Он позволяет отдавать содержимое страницы в более чистом текстовом формате, удобном для AI-агентов, LLM, поисковых систем и технических интеграций.
Плагин добавляет в ссылки на AI-файлы.

Пакет подходит для сайтов на Joomla 5+, которым важно сделать контент понятнее для LLM, AI-поиска, ассистентов и будущих систем машинного чтения.

Видео:
- ВК Видео
- RuTube
- YouTube

Ссылки:
Страница расширения
GitHub

@joomlafeed

0 Пользователей и 1 Гость просматривают эту тему.
  • 3 Ответов
  • 921 Просмотров
*

Sergeych

  • Захожу иногда
  • 161
  • 25 / 0
[УДАЛИТЕ]
« : 27.01.2021, 13:51:17 »
Привет All

Созидаю плагин контента (учусь) для поиска определенного содержания в файлах (pdf) фигурирующих в виде ссылок в материалах...

Есть материал Joomla вида
Код
some text
some text
some text
<a href="/files/name1.pdf">name1</a>
<a href="/files/name2.pdf">name2</a>
<a href="/files/name3.pdf">name3</a>
some text
some text

Нужно в материале (т.е. $article->text ) определить ссылки на файлы (например pdf), прочитать их (или лучше прочитать скажем первые 100КБ потому как файлы могут быть большие и их может быть много) и если внутри файлов есть последовательность например
Код
$code='123456789';
то вывести после ссответствующих ссылок уведомление, например
Код
$ahtung='сode inside!';
Если-бы я искал этот $code в тексте самого материала, то сделал-бы что-то типа (в функции onContentPrepare)
Код
if (strpos($article->text, $code)) //проверяем, есть ли в материале искомый $code
{
$html =$code . ' - ' . $ahtung;
$article->text = str_replace($code, $html, $article->text);
}
else return false;

Т.е. нужно, чтобы исходный материал преобразовался при выводе к виду типа
Код
some text
some text
some text
<a href="/files/name1.pdf">name1</a>
<a href="/files/name2.pdf">name2</a> - сode inside!
<a href="/files/name3.pdf">name3</a> - сode inside!
some text
some text
ну как-то так...

Братцы, помогите тупенькому  >:(
« Последнее редактирование: 02.02.2021, 09:36:43 от Sergeych »
*

beliyadm

  • Легенда
  • 9758
  • 1665 / 66
  • Севастополь, Россия
Re: PHP-шники, тупенькому
« Ответ #1 : 27.01.2021, 20:43:25 »
Сложная задача.
Для начала курить Google php поиск в pdf и прочие подобные запросы на буржуйском.
Дальше - 90% контента в ПДФ - это отсканированные картинки, поиск по которым без распознавания текста (что на PHP невозможно) работать естессно не будет.

Просто найти в контенте документы в формате PDF - не сложно, обработать и вытащить оттуда текст (если он текст) - сложно, если там картинка - невозможно.
Не лучший пример для обучения, возьмите тот же WORD\TXT для начала
Все истины, которые я хочу вам изложить, — бесстыдная ложь. Сделать всё хорошо
TLG: @Beliyadm
*

Sergeych

  • Захожу иногда
  • 161
  • 25 / 0
Re: PHP-шники, тупенькому
« Ответ #2 : 27.01.2021, 23:20:08 »
Сложная задача.
Для начала курить Google php поиск в pdf и прочие подобные запросы на буржуйском.
Дальше - 90% контента в ПДФ - это отсканированные картинки, поиск по которым без распознавания текста (что на PHP невозможно) работать естессно не будет.
Это не требуется, искомый фрагмент текста встречается единственный раз и он там точно есть в виде именно просто текста (проверяю открывая pdf файл блокнотом++) или его там нет в принципе. Это как раз не сложно...
Что-то типа:
Код
if (strpos(file_get_contents("name1.pdf"), "$code")) echo "Есть"; else echo "Нету";

Цитировать
Просто найти в контенте документы в формате PDF - не сложно ...
Помоги Друг  *DRINK* я дико туплю. Т.е. примерно понимаю как, но применительно к onContentPrepare вообще поплыл ((
Цитировать
Не лучший пример для обучения, возьмите тот же WORD\TXT для начала
Можно, но думаю для моей конкретной задачи разницы нет
« Последнее редактирование: 28.01.2021, 16:42:07 от Sergeych »
*

beliyadm

  • Легенда
  • 9758
  • 1665 / 66
  • Севастополь, Россия
Re: PHP-шники, тупенькому
« Ответ #3 : 27.01.2021, 23:26:56 »
Ты гуглишь вообще не в ту сферу
onContentPrepare - это событие плагинов, если контент готов - делаем то-то или это
Так то да, можно на этом событии обработать пдф, если ты умеешь вытаскивать данные уже - то я вообще не вижу проблемы
Все истины, которые я хочу вам изложить, — бесстыдная ложь. Сделать всё хорошо
TLG: @Beliyadm
Чтобы оставить сообщение,
Вам необходимо Войти или Зарегистрироваться