【
Умный городКолонка сетевых брендов« Если кто - то плавает в водохранилище, будьте бдительны вовремя. » В прошлом это была директива, адресованная администраторам безопасности, а на Всемирной конференции по искусственному интеллекту 2026 года (WAIC 2026) компания Haikowvision продемонстрировала совершенно новую возможность - передать эту задачу непосредственно на камеру.

17 июля, в первый день открытия WAIC 2026, Haikowvision выпустила мультимодальную интеллектуальную камеру, которая достигла « одного слова, чтобы заставить камеру работать. Например, в сценарии управления безопасностью водохранилища традиционная камера видит, что есть « человек» и « вода», а мультимодальная интеллектуальная камера, которая устанавливает задачу, может не только контролировать зону риска в режиме реального времени, точно описать фигуру, состояние и окружающую среду в сцене, лучше понять сцену, определить, что « человек плавает с риском утопления», активно подключить рог, чтобы отправить предупреждение. Эта способность « понимать, понимать, исполнять» означает, что камера эволюционирует как « умный помощник» для активного обслуживания.

Этот прорыв был достигнут благодаря глубокому слиянию многомодальных больших моделей с периферийными вычислительными архитектурами. Ответственное лицо Haikowvision: « Мы поместили многомодальную большую модель в этот небольшой фюзеляж, чтобы он мог не только точно воспринимать, но и быстро распознавать, судить, реагировать, адаптироваться к подобным напоминаниям о близости воды, которые касаются этой ситуации безопасности и требуют более высоких требований к работе в режиме реального времени». По сравнению с традиционными камерами, мультимодальная интеллектуальная камера обладает более сильной способностью к пониманию сцены, более гибкой конфигурацией задач и способностью обрабатывать края в режиме реального времени.
В частности, традиционные камеры могут видеть только то, что находится на экране, а камеры с одной большой визуальной моделью могут понимать, что находится на экране, но не могут реагировать на инструкции человеческого языка. Мультимодальная интеллектуальная камера благодаря мультимодальной способности достигла тройного скачка: во - первых, интерактивное обновление, от написания сложных правил до прямого выражения потребностей; Во - вторых, понимание обновления, от идентификации "есть группа людей" до понимания "они плавают, есть риск"; В - третьих, обновление принятия решений, от пассивного оповещения до активного подключения акустической и световой связи, уведомления и контроля.
Что касается вычислительной силы и параметров, мультимодальная интеллектуальная камера интегрирует вычислительную силу 26T, встроенную многомодальную модель с параметрами 2B, поддерживает глубокое понимание графического текста и семантический анализ, на стороне может быть реализовано многомодальное интерактивное замкнутое кольцо, может широко использоваться в области общественной безопасности, городского управления, промышленного производства, безопасного производства и других областях.
Стоит отметить, что мультимодальные интеллектуальные камеры поддерживают управление естественным языком и могут эффективно повысить эффективность бизнеса. Для применения в сценарии безопасного производства в качестве примера, пользователю просто нужно ввести естественный язык, например, « персонал, который входит в строительную зону без светоотражающей рубашки, пожалуйста, сигнализирует», система немедленно преобразует его в динамические правила управления распределением, боковой видеопоток в реальном времени, как только он соответствует цели, сразу же вызывает тревогу и поддерживает подключение акустического, светового и дверного контроля и других периферийных устройств. От пассивного поиска до активной защиты, после проверки до вмешательства в вещи, для достижения управления замкнутым контуром.
На выставке WAIC 2026 Haikowview зрители также могут лично испытать этот « доступный» интеллект. Нажмите на фразу на экране, например, « Какая это сцена, анализ рискованного поведения в сцене» или « Проверьте, плавает ли кто - то на экране, если есть, оповещение», мультимодальная интеллектуальная камера может автоматически анализировать видеоконтент и генерировать результаты графических вопросов и ответов в режиме реального времени на экране, предупреждающее сообщение, а также совместно отправить голосовое предупреждение « Здесь запрещено плавать, пожалуйста, уходите как можно скорее».
Эта демонстрация не только интуитивно демонстрирует силу Haikonvision в графическом понимании взаимодействия с естественным языком, но и позволяет зрителям в прямом эфире почувствовать, что большая модель - это не просто « может понять », но и « может говорить » « может работать » и является интеллектуальным помощником, который действительно может укорениться в первой сцене.
От напоминаний о близости водохранилища до безопасного производства на заводах, от городского управления до интеллектуальной розничной торговли... В прошлом многие сценарии интеллектуального анализа были ограничены пропускной способностью сети или стоимостью облачных вычислений, что затрудняло реагирование в реальном времени. Благодаря глубокому накоплению в области интеллектуальных IoT, Haikowvision продолжает продвигать технологию AI на краю посадки, и выпуск мультимодальных интеллектуальных камер в настоящее время знаменует собой то, что возможности AI действительно могут опуститься до последнего километра промышленного применения, что придаст новый импульс цифровой трансформации Qianbing.