Благодаря голосовой диктовке ИИ все больше людей озвучивают свои электронные письма, сообщения и код.

Гэвин Макнамара отказался от клавиатуры и весь день говорит, а не печатает.

Он часами разговаривает со своим компьютером и телефоном, отправляет электронные письма, пишет презентации, публикует сообщения в LinkedIn и даже пишет код в разговорах, используя приложение для диктовки с использованием искусственного интеллекта от стартапа из Сан-Франциско Wispr Flow.

ИИ расставляет акценты, форматирует и адаптирует его бессвязную речь в связную копию. Макнамара в среднем печатает 125 слов в минуту, что вдвое превышает среднюю скорость набора текста.

«На данный момент все, что можно сделать, набрав текст, я делаю, говоря», — сказал 32-летний основатель агентства по разработке программного обеспеченияWhy Not Us. «Я просто говорю».

За последние пять месяцев в 77 приложениях он продиктовал почти 300 000 слов — это эквивалентно написанию трёх романов.

Калифорнийские технологические гиганты и стартапы находятся в авангарде движения за использование искусственного интеллекта и больших языковых моделей, на которых он основан, чтобы подтолкнуть людей к взаимодействию с технологиями, используя свои голоса, а не пальцы.

«ИИ и степень магистра права изменили динамику», — сказал Си Джей Пайс, создатель бесплатного приложения Handy для голосовой диктовки из Сан-Диего. «Использовать голос намного быстрее, чем печатать».

Множество независимых разработчиков и стартапов, в том числе Handy, Wispr Flow и Willow из Сан-Франциско и другие, начали предлагать точное голосовое взаимодействие с искусственным интеллектом.

Крупнейшие имена в сфере технологий также создают новые способы сотрудничества с искусственным интеллектом. Новейшие умные очки Meta полагаются на голос. OpenAI и Meta разработали индивидуальные особенности для голосовых чатов своих ботов. Даже Alexa от Amazon и Siri от Apple проходят модернизацию искусственного интеллекта, что, как ожидают компании, заставит всех гораздо больше общаться с их технологиями.

Эти бесплатные и платные методы использования устной речи на компьютерах привлекли миллионы пользователей, в том числе программистов, помощников руководителей, юристов, создателей контента и практикующих врачей. Некоторые оптимисты считают, что клавиатура может устареть.

Read more:  Центры обработки обработки данных должны будут использовать ископаемое энергию / статью больше

«Я рад сообщить, что мы убрали клавишные из самых престижных телевизионных наград в мире», — заявил Аллан Го, основатель Willow, в сообщении на LinkedInотметив, что команда премии «Эмми» использовала голосовую диктовку Уиллоу для отправки сообщений Slack и более быстрой очистки почтовых ящиков при подготовке к премии 2026 года.

На протяжении многих лет крупные технологические компании адаптированный многие из их продуктов оснащены голосовыми функциями – для удобства. Сегодняшний поворот от голоса как функции доступности к инструменту повышения производительности.

В конце 2022 года создатель ChatGPT начали раздавать неограниченный доступ к своей модели автоматического распознавания речи под названием Whisper, обученной на 680 000 часов многоязычных данных. OpenAI поделилась технологией точной транскрипции звука, которая когда-то была тщательно охраняемой большой технической тайной. Теперь любой желающий мог бесплатно скачать и запустить высококачественную транскрипцию с помощью искусственного интеллекта. на своем ноутбуке.

Новая волна приложений для диктовки с использованием искусственного интеллекта использует Whisper в качестве основы и опирается на нее, предлагая диктовку в реальном времени. Хотя существуют бесплатные альтернативы, платная подписка стоит от 8 до 12 долларов в месяц.

Диктовка на основе искусственного интеллекта сейчас завоевывает популярность среди программистов и обычных пользователей и заставляет людей разговаривать со своими ноутбуками. Первые пользователи говорят, что диктовка позволяет им работать быстрее, мыслить яснее и быть более продуктивными, будь то написание электронных писем, отправка SMS, разработка веб-сайта или задание ИИ.

“Люди, которые активно освоили голосовую связь, не вернутся. Когда вы разговариваете 20 часов в неделю на своем ноутбуке, набор текста становится для вас трудным”, – сказал Навин Найду, генеральный менеджер нью-йоркского приложения для голосовой диктовки Monologue. “Я думаю, к чему это приведет: голос становится слоем делегирования. Вы говорите о своем намерении, и все происходит”.

Read more:  Пациенты не получают больничные письма, так как NHS Trust «не может позволить себе бумагу» | Великобритания | Новости

Эти новые приложения для диктовки с использованием искусственного интеллекта используют возможности Apple. передовые чипы на iPhone и Mac для запуска частной диктовки на устройстве.

Джеффри Хантли, независимый разработчик программного обеспечения, в июне почти полностью перешел на голосовую работу.

Он часто начинает проекты, открывая голосовую подсказку и прося ИИ опросить его о своих проблемах и требованиях к проекту, прежде чем будет сгенерирован какой-либо код.

«Я говорю с ним, как будто играю в джаз-бэнде, взад, вперед, назад, вперед», — сказал Хантли. Этот вокальный танец помогает уточнить спецификации, затем за руль берется ИИ. и создает программное обеспечение.

Помимо написания кода, Хантли использует голос, чтобы «разорвать» его при записи идей для постов в блоге или обмене сообщениями, используя такие приложения, как Супершепот или Whisper Flow, чтобы получить «первый дамп» мыслей, прежде чем перейти к клавиатуре для окончательного редактирования.

Все большее число разработчиков программного обеспечения в Кремниевой долине часами диктуют инструкции по кодированию вместо того, чтобы печатать. Сочетание быстро развивающихся агентов искусственного интеллекта, способных кодировать часыблагодаря голосовому вводу, позволяющему улавливать мысли быстрее, чем вводу текста, их продуктивность повысилась.

Макнамара, называющий себя «виброкодером», за несколько месяцев создал более 25 веб-приложений — скорость разработки, которая была бы невозможна без голосовых инструкций.

«Я не думаю, что [typing]Во всяком случае, было бы даже эффективно или эффективно достичь цели так же быстро, как я это сделал с помощью разговора», — сказал Макнамара.

Он использовал извилистый разговор и несколько часов, чтобы заставить ИИ построить Подарки Ростковреестр подарков для детей и приложение для оценить любой товар по фотографиям.

Конечно, ИИ может ошибаться, и его работу нужно проверять.

Read more:  ПОСЛЕДНИЕ СООБЩЕНИЯ ОБ ИЗВЕРЖЕНИИ: 02/1154Z EST VA DTG: 02/1510Z

Между тем, широкое распространение принесло новые неудобства, поскольку даже опытные пользователи чувствуют себя неловко, разговаривая со своими ноутбуками. Переполненные открытые офисы не предназначены для одновременного общения большого количества людей за компьютерами.

«Люблю голос, но не в офисе», — сказал один пользователь на X. “Я не люблю разговаривать с другими людьми. Я бы делал это в офисе за закрытыми дверями или ездил на работу в машине”.

Макнамара пользуется наушниками, поэтому люди думают, что он разговаривает по телефону.

«Это что-то вроде социального хака, который у меня есть», — сказал он.

Хотя еще слишком рано говорить о том, может ли Qwerty-клавиатура вслед за телеграфной лентой и факсами устареть, и если да, то когда, скорость передачи голоса ускоряется, говорит Дилан Фокс, основатель компании Assembly AI из Сан-Франциско, которая предлагает компаниям аудиомодели.

«Мы определенно находимся в начале пути к тому, что мы называем 10-100-кратным увеличением спроса на голосовые приложения, приложения и интерфейсы искусственного интеллекта», — сказал он.

Для программиста Макнамары больше общения с чат-ботами сделало его лучшим другом.

Раньше он плохо отвечал на сообщения. Теперь он сразу возвращается к друзьям.

«Я так быстро отвечаю, что они такие: «Кто этот парень?» — сказал он.

2026-01-29 11:03:00


1769691206
#Благодаря #голосовой #диктовке #ИИ #все #больше #людей #озвучивают #свои #электронные #письма #сообщения #код

Ещё по этой теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.