
Достаточно странно, что никто не написал, но, на мой взгляд, сегодня произошло знаковое событие. IBM представила новый, полностью законченный чип, реализующий нейронную сетку. Программа его разработки, существовала давно и шла достаточно успешно. На Хабре уже была статья о полномасштабной симуляции.
Читать полностью »
Рубрика «обработка изображений» - 89
TrueNorth — процессор нового поколения
2014-08-07 в 23:43, admin, рубрики: искусственный интеллект, микропроцессоры, нейронные сети, обработка изображений, ПроцессорыМанипуляции с объектами на фотографиях в 3D
2014-08-06 в 22:58, admin, рубрики: 3d-фото, Анимация и 3D графика, будущее рядом, Научно-популярное, обработка изображений, теперь объем тоже можно подправить 
Как сообщает CNET, исследователи из университета Carnegie Mellon разработали технологию, позволяющую делать плоские объекты на фото объёмными, и свободно манипулировать ими.
Читать полностью »
«Кассини» получил снимок «глаза Сатурна»
2014-08-06 в 14:10, admin, рубрики: глаз сатурна, кассини, космонавтика, обработка изображений, планеты-гиганты, Сатурн 
Атмосферные бури на Юпитере и Сатурне — очень интересные объекты для изучения. На Юпитере наиболее известным является «Большой вихрь», образование, в котрое можно поместить пару десятков Земель.
На Сатурне это шестигранный атмосферный шторм, который не так давно был снят на видео аппаратом «Кассини» с применением цветных фильтров.

Теперь Кассини, пролетая на расстоянии 2,2 миллионов километров от Сатурна, получил детальный снимок «глаза Сатурна» — центра того самого шестиугольного шторма. По оценкам специалистов, диаметр «глаза» составляет 2 тысячи километров.
Голливуду не дают печатать фальшивые доллары
2014-08-03 в 20:55, admin, рубрики: Голливуд, обработка изображений, фальшивомонетчествоДля съёмки голливудских блокбастеров требуется огромное количество наличных долларов. По сюжету фильмов, их передают в чемоданах, перевозят в микроавтобусах, они должны лежать в банковских хранилищах и т.д… Но здесь кинопроизводителям ставит палки в колёса Секретная службы США, чья обязанность — борьба с фальшивомонетчеством.

Настоящая и поддельная купюра производства Independent Studio Services
Производством фальшивых купюр для голливудских студий занимается две частные фирмы. Одна из них — Independent Studio Services (ISS). Представители этой компании жалуются на исключительный идиотизм сотрудников Секретной службы США. Например, для фильма «Час пик 2» в 2001 году они изготовили купюры с надписью “In Dog We Trust” вместо оригинальной надписи “In Goв We Trust”, заменили главное фото и ещё 28 характеристик купюры. Это не спасло их от преследования. Агенты сказали, что купюра всё равно слишком похожа на настоящую: она такого же цвета и на ней указан номинал.
Читать полностью »
Новая технология подстраивает изображение на дисплее для людей с нарушениями зрения
2014-08-01 в 7:38, admin, рубрики: MIT, Блог компании Medgadgets, дисплеи, Железо, коррекция зрения, обработка изображений 
На днях в Сети появилась интересная информация о совместной разработке MIT и Университета Беркли. Объединенная команда разработчиков создала прототип дисплея, который будет автоматически подстраиваться под уровень зрения человека.
То есть в оптических очках нет нужды — изображение на дисплее будет автоматически подстраиваться таким образом, чтобы человек видел четкое изображение.
Алгоритм «понимает», каким путем определенное расстройство зрения у человека приводит к искажению обычной «картинки», и корректирует изображение соответствующим образом. В световом фильтре, размещаемом на дисплее, есть небольшие отверстия. И алгоритм, изменяя светимость каждого пикселя, позволяет подавать световые лучи на сетчатку глаза таким образом, чтобы на роговице глаза создавалось четкое изображение.
Эксперимент интеграции видео расширения в систему аудио-распознавания речи
2014-07-31 в 19:33, admin, рубрики: api, анализ движения в объекте интереса, видео распознавание, математика, обработка изображений, Работа со звуком, распознавание образов, распознавание речи, синхронизация аудио-видео потоков
Вместо введения
Продолжаю вести серию отчетов по исследовательской работе, которую проводил на протяжении нескольких месяцев, обучаясь в университете и в первые месяцы после защиты диплома. За все время работы многие элементы системы, которую разрабатывал, прошли переоценку и вектор работы в целом серьезно изменился. Тем интереснее было взглянуть на свой предыдущий опыт и опубликовать нигде не изданные ранее материалы с новыми замечаниями В данном отчете публикую материалы, почти 2-х летней давности со свежими дополнениями, которые надеюсь еще не потеряли свою актуальность.
Содержание:
1. Поиск и анализ цветового пространства оптимального для построения выделяющихся объектов на заданном классе изображений
2. Определение доминирующих признаков классификации и разработка математической модели изображений мимики"
3. Синтез оптимального алгоритма распознавания мимики
4. Реализация и апробация алгоритма распознавания мимики
5. Создание тестовой базы данных изображений губ пользователей в различных состояниях для увеличения точности работы системы
6. Поиск оптимальной аудио-системы распознавания речи на базе открытого исходного кода
7. Поиск оптимальной системы аудио распознавания речи с закрытым исходным кодом, но имеющими открытые API, для возможности интеграции
8. Эксперимент интеграции видео расширения в систему аудио-распознавания речи с протоколом испытаний
Цели:
На основе накопленного опыта в предыдущих исследовательских работах, осуществить пробную интеграцию видео-расширения в систему аудио-распознавания речи, провести протоколы испытаний, сделать выводы.
Задачи:
Рассмотреть подробно как можно интегрировать видео-расширение с программы распознавания речи, исследовать сам принцип аудио-видео синхронизации, а также осуществить пробную интеграцию разрабатываемого видео расширения в систему аудио распознавания речи, оценить разрабатываемое решение.
Введение
В ходе проведения предыдущих исследовательских работ были сделаны выводы целесообразности использования аудио-систем распознавания речи на базе открытого и закрытого исходного кода под наши цели и задачи. Как было нами определено: реализация своей собственной системы распознавания речи является очень сложной, трудоемкой и ресурсозатратной задачей, которую сложно выполнить в рамках данной работы. Поэтому нами было решено интегрировать представленную технологию видео-идентификации в системы распознавания речи, которые имеют для этого специальные возможности. Так как системы распознавания речи с закрытым исходным кодом реализованы более качественно и точность распознавания речи в них выше за счет более емкого содержания словника, то поэтому интеграция нашей видео-разработки в их работу следует считать более перспективным направлением, по сравнению с аудио системами распознавания речи на базе открытого исходного кода. Однако же необходимо иметь в виду тот факт, что системы распознавания речи с закрытым исходным кодом часто имеют сложную документацию для возможности интеграции сторонних решений в их работу с серьезными ограничениями использования системы на основе лицензионного соглашения или же это направление является платным, то есть необходимо покупать специальную лицензию на использование речевых технологий, представленных лицензиантом.
Для начала в качестве эксперимента было принято решение попробовать улучшить качество распознавания речи системы распознавания речи Google Speech Recognition API за счет работы нашего разрабатываемого видео расширения. Замечу, что на время проведения испытаний у Google Speech API на базе браузера Chrome еще не было функции распознавания непрерывной речи Google, которая в то время уже встраивалась в технологию распознавания непрерывной речи Speech Input на базе ОС Android.
В качестве видео обработки за основу взято наше решение по анализу движения губ пользователя и алгоритмам фиксирования фазы движения точек в объекте интереса совместно с аудио обработкой. С тем, что в конечном итоге получилось можно ознакомиться ниже.

Читать полностью »
«Путевые» фотографии межпланетной станции Rosetta: с 2005 года по настоящее время
2014-07-25 в 9:06, admin, рубрики: rosetta, астероиды, Земля, космонавтика, межпланетные станции, обработка изображений, робототехника, Розетта 
Это не фотография, а рисунок, фантазия художника. Фотографии — под хабракатом.
Межпланетная станция Rosetta с зондом Filae на борту находится уже примерно в 3 тысячах километров от своей цели, кометы Чурюмова-Герасименко. Напомню, именно на эту комету запланирована высадка зонда в начале августа. Как уже ранее писали на Хабре, Rosetta сделала наиболее подробные снимки кометы Чурюмова-Герасименко, и после анализа фотографий оказалось, что ядро у кометы — двойное.
Интересно еще и то, что кроме непосредственной свой задачи — изучения ядра кометы, подробного фотографирования кометы и всего прочего, станция Rosetta выполняла и побочные задания. Например, фотографировала многие интересные объекты, начиная с 2005 года (момент запуска станции), и заканчивая этим месяцем. В продолжении — галерея этих фотографий с описанием каждой.
Мониторинг лесных пожаров
2014-07-22 в 20:56, admin, рубрики: видеонаблюдение, Геоинформационные сервисы, Компьютерное зрение, обработка изображений, пожары, Работа с видеоВ Псковской области много лесов, и, соответственно, в теплое время года много пожаров — горят и сами леса, и торфяники. Людей, чтобы отследить такие массивы, не хватает.
Что делают псковичи? Лезут на сотовые вышки и ставят там видеокамеры:

Читать полностью »
Проект McMoon: новые технологии дают второе рождение фотографиям Луны программы Lunar Orbiter 60-х годов
2014-07-21 в 7:35, admin, рубрики: космонавтика, обработка изображений 
Исходная фотография 60-х и ее современная инкарнация
В 1960-х годах агентство NASA запустило программу Lunar Orbiter, цель которой — найти пригодные для посадки площадки на Луне, которые использовались экспедициями Apollo. В частности, данными программы Lunar Orbiter воспользовались и для планирования посадки модуля Apollo-11, с двумя людьми, которые и стали первыми представителями человечества на Луне.
Каждый из аппаратов Lunar Orbiter был оснащен особой двухобъективной камерой. Пока один объектив получал изображение поверхности большой площади, второй снимал мелкие детали поверхности. В проекте использовалась 70мм пленка, которая, в теории, позволяла получить очень качественные фотографии.
Тем не менее, пленка на Землю не попала — по плану, аппараты Lunar Orbiter, по завершению своей миссии, падали на Луну. Каждый аппарат был оснащен еще и модулем проявления пленки, и передачи данных на Землю. В итоге, как и следовало ожидать, качество фотографий, получаемых на Земле, было хуже, чем в случае непосредственной работы с пленкой. Помехи, наводки, огромное расстояние — все это приводило к ухудшению качества сигнала, и, соответственно, получаемых на Земле изображений.
Некоторые методы поиска нечетких дубликатов видео
2014-07-21 в 0:47, admin, рубрики: data mining, gist, lhs, Алгоритмы, видео, обработка изображений, сравнение видео, сравнение изображений, хэшированиеСуществует достаточно широкий круг задач, где требуется анализ, аудио-визуальных моделей реальности. Это относится и к статическим изображениям, и к видео.

Ниже приведен не большой обзор некоторых существующих методов поиска и идентификации нечетких дубликатов видео,
рассмотрены их преимущества и недостатки. На основе структурного представления видео построена комбинация методов.
Обзор совсем не большой, за подробностями, лучше обращаться к первоисточникам.
