Новости Joomla

Компонент Joomla 6: Генератор LLMs.txt.

Компонент Joomla 6: Генератор LLMs.txt.

Компонент Joomla 6: Генератор LLMs.txt.

Ещё один генератор ИИ-файлов llms.txt и llms-full.txt.

Основные особенности/возможности компонента:

  • Генерация по стандарту: Автоматическое создание файла-визитки llms.txt и расширенной версии llms-full.txt с аннотированным списком материалов.
  • Интеллектуальная работа с контентом: Компонент использует мета-описания (Meta Description) из статей и пунктов меню, превращая SEO-настройки сайта в качественный контекст для нейросетей.
  • Просмотреть результат генерации файлов можно сразу в рабочей области компонента. После внесения корректив (через Настройки компонента. При отладке лучше открыть три вкладки в браузере: Настройка — Геренация/Превью — Список Материалов/Категории/Меню.) — проводим перегенерацию, смотрим результат до полной «победы».
  • Автоматизация и безопасность: Синхронизация с sitemap.xml, группировка по категориям и автоматическое создание резервных копий (.bak) при каждой генерации.
  • Гибкое управление: Возможность исключения определенных категорий и/или статей и/или пунктов меню, а также простая настройка через стандартную админпанель Joomla.
  • Подробное руководство/справка: Пошаговая инструкция для пользователя в Настройках компонента для редакторов с базовым знанием администрирования Joomla.

👉 Важно учесть.
1️⃣ Компонент Генератор LLMs.txt изначально составляет базовый список ссылок на основе sitemap.xml и сверяется с ним на предмет: запрета индексации url в robots.txt, тегов noinex/nofollow. Это экономит время на проверку «закрыть от индексации», поскольку компонент генерации Sitemap.xml уже реализовал эту задачу. Посему, формирование ссылок для ИИ имеет комплексный подход, составление грамотного/валидного/релевантного sitemap.xml никто не отменял.

2️⃣ Тексты-описания ссылок формируются из Meta Description com_content (только компонент Материалы) и выбранных пользователем Меню сайта. Важно, чтобы Meta Description были уникальными и релевантными, соответствовали базовому seo. Составленные «на отшибись» Description для ИИ — «не катит» (впрочем, для поисковых систем они тоже «не канали»).

Разработчик - участник нашего сообщества Александр Кузнецов (@newvksan).

Страница расширения

@joomlafeed

#joomla #ии #ai

👩‍💻 WT LLMs для Joomla: llms.txt, llms.json для AI-агентов.

👩‍💻 WT LLMs для Joomla: llms.txt, llms.json для AI-агентов.

Это Joomla-компонент для публикации AI-ready карты сайта и автоматической генерации файлов llms.txt, llms-full.txt и llms.json по концепции llmstxt.org.  Также о концепции llms.txt говорит Google в своей справке Lighthouse. Решение помогает LLM-моделям, AI-агентам, GEO/AI SEO-процессам и внутренним автоматизациям получать структурированные данные о сайте без ручной сборки JSON и Markdown.

С помощью WT LLMs можно:
- создать структурированное описание сайта для AI-агентов;
- управлять профилем сайта, картой интентов и каноническими страницами для этих интентов из админки Joomla;
- генерировать llms.txt и llms.json;
- использовать REST API для автоматического заполнения данных;
- отдавать публичную schema-инструкцию для AI-агентов;

В комплект компонента входит плагин markdown-версии страниц Joomla. Системный плагин Joomla, который добавляет альтернативное Markdown-представление страниц сайта. Он позволяет отдавать содержимое страницы в более чистом текстовом формате, удобном для AI-агентов, LLM, поисковых систем и технических интеграций.
Плагин добавляет в ссылки на AI-файлы.

Пакет подходит для сайтов на Joomla 5+, которым важно сделать контент понятнее для LLM, AI-поиска, ассистентов и будущих систем машинного чтения.

Видео:
- ВК Видео
- RuTube
- YouTube

Ссылки:
Страница расширения
GitHub

@joomlafeed

0 Пользователей и 1 Гость просматривают эту тему.
  • 18 Ответов
  • 3665 Просмотров
*

azim

  • Захожу иногда
  • 113
  • 0 / 0
  • Добрый ТУРИСТ
*

faraon_x

  • Захожу иногда
  • 362
  • 27 / 1
  • Чем смогу, тем помогу )))
Реальные имена можно увидеть? В каких поисковиках Вы смотрите и с помощью чего смотрите?
Вопросы по JFORMS, можно ещё попробовать задать здесь
Российский 3d сканер от разработчиков и производителей
*

BaR

  • Захожу иногда
  • 86
  • 6 / 0
Этот сервис какойто не правдоподобный, зарегистрируйтесь в гугле в яндексе и увидите какие страницы проиндексированы и сколько, для примера, проверил свой сайт (1.5),  по данным этого сервиса та же самая проблема, но гугл выдал совсем противоположные данные.
з.ы. воспользуйтесь сервисом гугла http://www.google.com/search?hl=ru&q=site:namesite.kiev.ua и увидите сколько ссылок вашего сайта он просканировал, и сравните результаты
« Последнее редактирование: 10.07.2009, 14:26:08 от BaR »
*

pbrigadir

  • Захожу иногда
  • 206
  • 10 / 0
з.ы. воспользуйтесь сервисом гугла http://www.google.com/search?hl=ru&q=site:namesite.kiev.ua и увидите сколько ссылок вашего сайта он просканировал, и сравните результаты
А еще лучше воспользаваться https://www.google.com/webmasters/tools/ отправить sitemap и в случае чего за пару часов увидеть чем робот был недоволен конкретно, если конечно ошибки имели место быть. Да и вообще в дальнейшем просматривать разные ошибки по ходу индексации страниц роботом - например битые ссылки найденые на ваших страницах и т.д.
Еще подобный сервис предоставляет яндекс - http://webmaster.yandex.ru/
*

azim

  • Захожу иногда
  • 113
  • 0 / 0
  • Добрый ТУРИСТ
К сожалению пока что  не могу проверить на практике.. так как у меня стоит запрет в роботс тхт ... так надо до августа...  как тока подровняю роботс так сразу попробую.... но все равно странно. половина сайтов нормально половина вот так вот хотя даже неправильные ссылки проиндексированы нормально!
*

BaR

  • Захожу иногда
  • 86
  • 6 / 0
К сожалению пока что  не могу проверить на практике.. так как у меня стоит запрет в роботс тхт ... так надо до августа...  как тока подровняю роботс так сразу попробую.... но все равно странно. половина сайтов нормально половина вот так вот хотя даже неправильные ссылки проиндексированы нормально!
Ссылки не правильно отображаются данным сервисом, роботы видят совсем не так как он показывает,например, у меня есть сайт который менее месяца в свете, так гугл его проиндексировал все страницы(их около 50), и ни одной ошибки, данный сервис все ссылки показал в похожем с вами виде.
*

турист

  • Захожу иногда
  • 160
  • 7 / 0
А еще лучше воспользаваться https://www.Google.com/webmasters/tools/
Подскажите, а в какой файл вставлять метатег который гугль дает при регистрации для проверки владельца сайта?
*

faraon_x

  • Захожу иногда
  • 362
  • 27 / 1
  • Чем смогу, тем помогу )))
в index.php он в корне сайта лежит
Вопросы по JFORMS, можно ещё попробовать задать здесь
Российский 3d сканер от разработчиков и производителей
*

турист

  • Захожу иногда
  • 160
  • 7 / 0
в index.php он в корне сайта лежит
А куда именно там??? Я пробовал в разные места и постоянно пишет, что не подтверждено. Пишет Он должен находиться в разделе <head>, перед первым разделом <body>. Но у меня в index.php ни раздела <head>, ни раздела <body> нет!!! Может я чего-то не понимаю?! Объясните, пожалуйста, будте добры!!!
Это все, что у меня в index.php:
<?php
/**
* @version      $Id: index.php 11407 2009-01-09 17:23:42Z willebil $
* @package      Joomla
* @copyright   Copyright (C) 2005 - 2009 Open Source Matters. All rights reserved.
* @license      GNU/GPL, see LICENSE.php
* Joomla! is free software. This version may have been modified pursuant
* to the GNU General Public License, and as distributed it includes or
* is derivative of works licensed under the GNU General Public License or
* other free or open source software licenses.
* See COPYRIGHT.php for copyright notices and details.
*/

// Set flag that this is a parent file
define( '_JEXEC', 1 );

define('JPATH_BASE', dirname(__FILE__) );

define( 'DS', DIRECTORY_SEPARATOR );

require_once ( JPATH_BASE .DS.'includes'.DS.'defines.php' );
require_once ( JPATH_BASE .DS.'includes'.DS.'framework.php' );

JDEBUG ? $_PROFILER->mark( 'afterLoad' ) : null;

/**
 * CREATE THE APPLICATION
 *
 * NOTE :
 */
$mainframe =& JFactory::getApplication('site');

/**
 * INITIALISE THE APPLICATION
 *
 * NOTE :
 */
// set the language
$mainframe->initialise();

JPluginHelper::importPlugin('system');

// trigger the onAfterInitialise events
JDEBUG ? $_PROFILER->mark('afterInitialise') : null;
$mainframe->triggerEvent('onAfterInitialise');

/**
 * ROUTE THE APPLICATION
 *
 * NOTE :
 */
$mainframe->route();

// authorization
$Itemid = JRequest::getInt( 'Itemid');
$mainframe->authorize($Itemid);

// trigger the onAfterRoute events
JDEBUG ? $_PROFILER->mark('afterRoute') : null;
$mainframe->triggerEvent('onAfterRoute');

/**
 * DISPATCH THE APPLICATION
 *
 * NOTE :
 */
$option = JRequest::getCmd('option');
$mainframe->dispatch($option);

// trigger the onAfterDispatch events
JDEBUG ? $_PROFILER->mark('afterDispatch') : null;
$mainframe->triggerEvent('onAfterDispatch');

/**
 * RENDER  THE APPLICATION
 *
 * NOTE :
 */
$mainframe->render();

// trigger the onAfterRender events
JDEBUG ? $_PROFILER->mark('afterRender') : null;
$mainframe->triggerEvent('onAfterRender');

/**
 * RETURN THE RESPONSE
 */
echo JResponse::toString($mainframe->getCfg('gzip'));
*

pbrigadir

  • Захожу иногда
  • 206
  • 10 / 0
А куда именно там??? Я пробовал в разные места и постоянно пишет, что не подтверждено. Пишет Он должен находиться в разделе <head>, перед первым разделом <body>. Но у меня в index.php ни раздела <head>, ни раздела <body> нет!!! Может я чего-то не понимаю?!
Немного внимания бывает полезно там у них есть такая ссылка http://www.Google.com/support/webmasters/bin/answer.py?answer=140369&hl=ru она будет Вам крайне полезна в данной ситуации.
Удачи.
*

pbrigadir

  • Захожу иногда
  • 206
  • 10 / 0
Извеняюсь запарился и недописал предыдущий пост...
Я имею ввиду что есть другой способ подтверждения прав сайта и его можно изменить. создаете файл с именем который говорит гугл и запихуете его в корень на хотинге. Этот способ помоему даже лучше тем что не нужно добавлять "мусор" в index.php. Кстати тоже самое и на яндексе.
*

турист

  • Захожу иногда
  • 160
  • 7 / 0
Да я и так тоже пробовал, не выходит. С Яндексом, кстати, без проблем все прошло. Не могу понять в чем дело :(
*

faraon_x

  • Захожу иногда
  • 362
  • 27 / 1
  • Чем смогу, тем помогу )))
Да я и так тоже пробовал, не выходит. С Яндексом, кстати, без проблем все прошло. Не могу понять в чем дело :(
Почему у Вас не получается закинуть файл на хостинг?
1. Создаете файл, если не ошибаюсь: dfkj3458kdfjkxckdjfdfdf.txt
2. Переносите его в корень сайта, там где папка: administrator, components,cache и т.д.
3. Нажимаете кнопку подтвердить.

Если не получается скиньте строчку Google, логин, пароль, домен сайта в личку, помогу.
Вопросы по JFORMS, можно ещё попробовать задать здесь
Российский 3d сканер от разработчиков и производителей
*

турист

  • Захожу иногда
  • 160
  • 7 / 0
Да файл-то создаю, закидываю в корень, с этим проблем нет, а вот Гугль все равно не подтверждает. Не видит он его :(
*

турист

  • Захожу иногда
  • 160
  • 7 / 0
а точно файл с расширением *.txt надо создавать??? у меня Гугль запрашивает: Googlee628acde04645096.html
*

faraon_x

  • Захожу иногда
  • 362
  • 27 / 1
  • Чем смогу, тем помогу )))
перепутал, это в яндексе *.txt. Проверьте имя файла, нет ли в нем пробелов. Если что давайте доступ к хостингу и файл, посмотрю в чем дело, и доступ к админки и тег от гугля, обоими способами надо попробовать.
« Последнее редактирование: 16.07.2009, 10:49:05 от faraon_x »
Вопросы по JFORMS, можно ещё попробовать задать здесь
Российский 3d сканер от разработчиков и производителей
*

Antik_26

  • Осваиваюсь на форуме
  • 33
  • 1 / 0
У Меня с яндексом тоже не получилось через файл, зато прокатило через мета тег. У Меня другая проблема после замен урлов на ЧПУ количество проиндексированных страниц увеличилось в три раза по отношению к количеству реальных страниц. Видимо это sef404 дубли контента налепил?
*

pbrigadir

  • Захожу иногда
  • 206
  • 10 / 0
У Меня другая проблема после замен урлов на ЧПУ количество проиндексированных страниц увеличилось в три раза по отношению к количеству реальных страниц. Видимо это sef404 дубли контента налепил?
Не всмысле? в тулсах пишет что допустим просканированно в сайтмапе 50стр а про индексированно 145? Если так то это может быть когда:
1. несколько раз скармливаешь Google сайтмап - тогда просто со временем проходит.
2. или разные файлы сайтмап, но с одним содержанием - тогда один нужно убрать.
*

pbrigadir

  • Захожу иногда
  • 206
  • 10 / 0
а точно файл с расширением *.txt надо создавать??? у меня Гугль запрашивает: Googlee628acde04645096.html
ну и правильно для Google должен быть html в папке mysite.ru/public_html или если поддомен соответственно mysite.ru/public_html/poddomen/
Чтобы оставить сообщение,
Вам необходимо Войти или Зарегистрироваться