Вход Блог
Строительство и ремонт
Репетиторы
Красота
Фрилансеры
Разные специалисты
Уход за животными
Тренеры
Автоинструкторы

Создание ИИ-ассистента — удалённая работа в Москве

Дата: 2026-02-04
Детали
Регион
Москва
Занятость
дистанционно
Стоимость
договорная
Дата публикации
2026-02-04
Описание
Сделать AI RAG-ассистента, который принимает документы (фото/сканы), голос, текст; извлекает факты; сохраняет; и по запросу пользователя возвращает нужную информацию. Это не «память модели», а управляемое хранилище + поиск + генерация ответа. 1) Что именно строим (компоненты) Ingestion (загрузка данных) Фото/сканы (билеты, паспорт) ? OCR ? текст + поля. Голос ? ASR (speech-to-text) ? текст. Текстовые заметки ? сразу текст. Нормализация и структурирование Разбиваем на чанки (кусочки текста). Опционально: извлекаем сущности/поля (ФИО, номер паспорта, даты вылета, PNR, номер рейса). Сохраняем: исходный файл (объектное хранилище), текст/чанки, структуру (JSON с полями), метаданные (пользователь, тип документа, дата загрузки, язык и т.д.). Индекс для RAG Эмбеддинги чанков ? векторная БД (Qdrant/Milvus/pgvector). Параллельно — ключевый поиск (BM25/Elastic) полезен для номеров/дат/кодовых строк. Гибридный поиск (vector + keyword) обычно лучший вариант. Retrieval + Answering Пользовательский вопрос ? переписывание запроса (опционально) ? поиск релевантных чанков ? LLM отвечает строго на основе найденного. Для «точных данных» (номер паспорта, дата, PNR) лучше дополнительно делать извлечение/проверку из структурных полей. Безопасность и изоляция Все данные привязаны к user_id (или tenant_id). Шифрование, контроль доступа, аудит. Для паспортов и билетов (PII) — маскирование при показе или политика “показывать только последние 4 цифры” по умолчанию. 2) Поток обработки: фото билета/паспорта Фото ? OCR ? классификация документа ? извлечение полей ? сохранение ? индексирование Рекомендуемые техники: OCR: Tesseract (просто) / PaddleOCR (часто лучше на сложных изображениях) / облачные OCR (Google/AWS/Azure). Паспорт: часто важен MRZ (машиночитаемая зона) — отдельный парсер MRZ даёт высокую точность. Билет: парсинг ключевых паттернов (рейс, дата, аэропорты, PNR/booking reference). 3) Поток обработки: голос Голос ? ASR ? текст ? (опционально) выделение фактов ? сохранение ? индекс ASR: OpenAI Whisper (локально/облачно) или аналоги. Сохраняйте также таймкоды/аудио-ссылку, если нужно подтверждение. 4) Как отвечать на запросы (2 режима) Режим A: “RAG-ответ” Вопрос: “Когда мой вылет в Берлин?” ? retrieval ? LLM формирует ответ + ссылка на источник (“из билета от …”). Режим B: “Факт из профиля” (структурные поля) Вопрос: “Какой номер паспорта я загружал?” ? лучше брать из структурных полей, а не из LLM-пересказа. ? выводить с маскированием: *******1234, и по запросу пользователя показывать полностью. На практике делают router: если вопрос про конкретные поля (номер документа, дата рождения, PNR) ? structured store иначе ? RAG 5) Минимальный стек (быстро собрать) Backend: Python + FastAPI OCR: PaddleOCR (или Tesseract на старте) ASR: Whisper Embeddings: любой совместимый (например, text-embedding-*), локальные тоже можно Vector DB: Qdrant (самый простой старт) Файлы: S3-совместимое (MinIO) Реляционка: Postgres (метаданные, пользователи, поля) 6) Схема данных (упрощённо) documents (id, user_id, type, created_at, original_uri) doc_chunks (id, document_id, chunk_text, chunk_index) embeddings (chunk_id, vector, metadata: user_id, doc_type, даты) extracted_facts (document_id, jsonb) — структурные поля 7) Ключевые детали, чтобы “работало как память” Версионирование: если пользователь перезалил документ, сохраняйте новую версию. Дедупликация: хэш файла/текста. Цитирование источника: возвращайте “взято из: билет …”. Политика конфиденциальности: какие поля можно показывать сразу, какие только после подтверждения. Оценка качества OCR: хранить confidence; при низком — просить переснять/переговорить. Многоязычность: нормализация дат/форматов. 8) Пример логики ответа (псевдопроцесс) Вопрос пользователя Классификатор запроса: “паспорт номер / дата рождения / PNR / номер рейса” ? structured lookup иначе ? RAG retrieval Retrieval: filter: user_id = текущий topK = 5–10 LLM: строгий системный промпт “отвечай только по контексту”.
Похожие заказы

Создание ИИ-ассистента

дистанционно
договорная
Пожелания и особенности: Медицинский центр. Www.mdcs.ru Интересует оптимизация сайта. Под ии. А также ответы на заявки с сайта.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Пожелания и особенности: Ищу специалиста для разработки персонального AI-ассистента «Е» на базе Telegram. Ассистент должен работать через LLM (OpenAI), иметь долговременную память, понимать контекст и выполнять команды пользователя. Основные функции: задачи и напоминания, календарь, голосовые сообщения, работа с файлами/документами, анализ ссылок и YouTube-видео, поиск по накопленной информации. В дальнейшем — интеграции с Google Sheets, Gmail, CRM и другими сервисами. Предполагаемый стек: n8n / PostgreSQL / OpenAI API / Telegram API / Docker, но готовы рассмотреть другую архитектуру. Важно построить стабильную и расширяемую систему, а не просто Telegram-бота с ChatGPT. Первый этап — рабочий MVP Telegram ? AI ? память ? задачи/напоминания без дублей и потери сообщений. Подробное ТЗ и логика развития проекта уже подготовлены.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Настроить gpt, Claude.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Пожелания и особенности: Обучение пользование ии ассистентом.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Пожелания и особенности: Удаленный профессионал по работе с клиентами / Менеджер по продажам / Стабильный оклад + % Мы предлагаем: ? Официальная оплата на карту банка (без задержек). ? Фиксированный оклад: 40 000 рублей с еженедельной выплатой. ? Процент со сделок: до 5% после выполнения плана. ? Средний доход: от 80 000 до 120 000 рублей в месяц. ? Поток клиентов: только горячие входящие заявки (холодных обзвонов нет). Клиентов очень много. ? Удаленная работа Кого мы ищем: Проактивного специалиста, который хочет зарабатывать, а не просто «сидеть на ставке». Опыт работы с CRM (Bitrix24) будет вашим преимуществом. Готовность оперативно обрабатывать входящий поток. Условия работы: Работа в Bitrix24 (всё прозрачно, контролируемо, обучаем). Поддержка и полное погружение в продукт. Новое направление крупной компании — карьерный рост и высокая конверсия. ?? Важно: Для отклика необходимо пройти короткое тестирование и ознакомиться с продуктом. Это займет 10-15 минут. Контакт для связи (Telegram) Если вы сейчас в активном поиске — рассмотрите это предложение. Ждем ваше тестирование! Мы работаем в нише авто продукции ??ЧТО ТАКОЕ ВОДОРОДНЫЙ ГЕНЕРАТОР H2PRO H2PRO — это водородная система, которая устанавливается под капот автомобиля. Внутри системы происходит электролиз воды: генератор вырабатывает HHO-газ (газ Брауна) и подаёт его во впуск двигателя вместе с воздухом и топливом. Из-за этого топливная смесь начинает сгорать более полно и эффективно. Проще говоря: двигатель начинает работать легче, чище и экономичнее. ?? Что устанавливается в автомобиль: ??водородный реактор ??бабблер / фильтр-сепаратор ??магистрали подачи HHO ??подключение к электросистеме автомобиля Всё оборудование размещается под капотом и работает во время движения автомобиля.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Пожелания и особенности: Менеджер по продажам каркасных домов и бань (Москва и МО). Обработка горячих лидов, доведение до сделки. Оплата: за % от продажи. Доход от 150 000?/мес. Без оклада и холодных звонков. Опыт в продажах строительства каркасных домов/знание каркасной технологии. Гибкий график, обучение, экскурсии на построенных объектах. Отклик: «Хочу в продажи.
Москва Фрилансеры

Создание ИИ-ассистента

дистанционно
договорная
Нужен ИИ-ассистент с понятной логикой работы, настройкой сценариев и запуском в рабочем виде. Важно собрать решение под конкретные требования и помочь с внедрением.
Москва Фрилансеры