THE SACRED COMPUTER - СВЕЩЕНИЯТ СМЕТАЧ, a.k.a. ARTIFICIAL MIND: Thinking Machines, Creativity and Human Development. A pioneering virtual Research Institute for Artificial General Intelligence (AGI), Cosmism and Transhumanism, AI, Software, Interdisciplinary General Research, Creativity, Versatility, Universal Men ~ Twenkids etc. Created in 2000. (...)
Политика и скандали. Как да стана милионер в България? Питаме BGGPT с ГЛАСОВ интерфейс чрез Свещеният сметач и прототипа на "Вседържец", в който през март внедрих разпознаване на реч и на български език чрез Whisper, и го свързах с управление на големи езикови модели като BgGPT и др., изпълнявани локално на личния сметач. Системата управлява също синтезатора на реч "Тошко 2" и ще бъде управлявана и от "Smarty 2" (нова версия на "най-умния речник") и непубликувания ми ускорител на изследователската дейност с много имена: Assistant, "Research Assistant", ACS.
На 29.3 като част от изпитанията на BgGPT и разработката на Вседържец, разговарях с компютърния оракул "BGGPT' за политика, скандали около водещите политически партии и политици като Бойко Борисов, Кирил Петков, Асен Василев, партиите им ГЕРБ, Продължаваме промяната, БСП, както и опозиционните. Питаме и как да станем милионери в България - политиката добър начин ли е? Следва продължение. Запис от 29.3.2024 с прототип от инфраструктурата за мислещи машини "Вседържец" (Вси, Специалист по всичко) на Тош.
Гледайте цялата поредица на "Свещеният сметач" за BGGPT, LLama-3, GPT-4, GPT2 и обучението му на български през 2021 г., LMSYS chat arena и др. големи езикови модели (LLM) в канала и от източниците на Сметача. Може да ви допаднат Дийпфейк поредиците "Арнолд: губернаторът на България" и "Амбългъл: Властелинът на пръстените на България" (предстои втори епизод). Подкрепете автора на ОРИГИНАЛНАТА стратегия за развитие на България и света с ИИ от 2003 г., която INSAIT преоткриват и копират със стотици пъти раздут бюджет и с 20 години закъснение.
Гледайте тук: https://youtu.be/4X9I15qmpdo и не забравяйте да се абонирате, коментирате и споделяте, ако ви е интересно и желаете да подкрепите "Свещеният сметач": оригиналното дружество и проект за развитие чрез Изкуствен интелект, за разлика от богатите копия 20 години по-късно. Помогнете на Сметача с гласност, хардуер, изчислителна мощ или с включването си в изследванията и разработката!
Тошко 2 - Bulgarian Text-to-Speech Synthesizer - Синтезатор на българска реч и малко английски
За Windows, но работеше и под Linux/Wine, възможно е да има проблеми с кодировките при копиране на текст - не съм пробвал напоследък, някой да опита и да коментира.
Виж папка: Versions
**Новини:** 12.2023: Оправен изпълнимия файл на 2.075, беше качена някаква неработеща версия. Компилиран е с VS 2019 x86, така че може да е нужно да се изтеглят съответните "Redistributable" files. https://learn.microsoft.com/en-us/cpp/windows/latest-supported-vc-redist?view=msvc-170
X86https://aka.ms/vs/17/release/vc_redist.x86.exePermalink for latest supported x86 version
Съвети: Играйте си с настройките за бързина (на гласни), съгласни (дължина на (шумови) съгласни)), височина - левите плъзгачи са за фина настройка, десните за по-груба с по-големи величини.
Също сменяйте интонацията: пробвайте различни, например дали РАВНО няма да ви допадне най-много (някои от другите имат прекалено големи амплитуди).
Могат да се правят нови интонационни контури, но като го създавах беше само пробна версия и се пишат ръчно числа, не се съобразява с вида изречения и т.н. (Въобще това беше по-разумно да е на Питон или друг скриптов език, а не на основния С++).
Също така препоръчвам да пробвате и бащата на Тошко 2:"Глас 2004", чиито глас няма интонация, не знае ударенията (може да слага, но само ръчно, докато Тошко 2 има известни основни познания, речник, който може и да се разширява) и не може да удължава или скъсява шумовите съгласни, но има по-фин контрол на синтеза до брой периоди на почтипериодичните функции и настройките на преходите звучат интересно ("виещо", както го наричах някога). Глас 2004 беше вграден в текстовия редактор "Писар", тогава известен като "българския Notepad". Изключително малък като размер - десетина килобайта, с някои по-добри възможности от тогавашния Notepad (за Windows 95, 98, ...) и въоблик на български: произволен шрифт, уголемянване.
ARNOLDIFIER: 3X Higher Performance Version of DeepfaceLab 2 Deepfake Library, achieved by refactoring it to work with Grayscale images. It achieves similar quality with either 3X less VRAM, or 3 times faster, 3X more detail/higher resolution faces for the same size of the models in VRAM and disk. All high quality models in the video are trained on a Geforce 750 Ti 2 GB (a 2014 entry-level GPU) - Arnoldifier allows training of quality and complex datasets with 192x192 or even 256x256 faces. Make your amazing deepfakes with any low end GPU and imagine the quality even with 1060 6 GB ( performance of a 3080, if it had 18 GB RAM ), or turning a Geforce 1070 GPU 8 GB into a 3090-24-GB-equivalent monster. The only trade-off is the color, but there is a colorization prototype in Arnoldifier, see in the video, and a post-production colorization can be done with additional tools as well.
Watch the series "Arnold Schwarzenegger: The Governor of Bulgaria", produced with the library and find it on Github. https://github.com/Twenkid/DeepFaceLab-SAEHDBW
Subscribe, like, share, comment - if you want to see more videos about the library, tutorials, code review etc. Thanks and see you in the next video!
СВЕЩЕНИЯТ СМЕТАЧ и ДРУЖЕСТВО ЗА ЗАЩИТА НА БЪЛГАРСКИЯ ЕЗИК - ДЗБЕ
Архив на българския Интернет, българска търсачка, услуги за наблюдение и анализ на съдържанието на медиите и др.
Запазване на данни и знания от българския и световния Интернет и тяхната аналитична обработка
Автор: Тодор Арнаудов - Тош, 11.9.2022 г.
Защо?
Отдавна имам тази идея, споменавал съм я на приятели, мислил съм да опитам да я направя за лични нужди - собствен паяк, който да събира най-важната за мен информация. Обаче за да се свърши както трябва е необходима повече енергия. Има някои частични малки архиви*/моментни снимки на части от стария Интернет (виж в бележките), но например наскоро беше закрит data.bg, който е пазел много древни файлове, вкл. някои мои от ранните времена на "Свещеният сметач" и 2000-те. Помните ли "free.techno-link"? Той загина много отдавна.
Hit.bg работеше години след като вече не беше "модерен", но и той отдавна е унищожен и не знам някой да му правил копие, освен каквото е оцеляло в Архив.орг (http://archive.org*) всъщност hit.bg се отваря от известно време, но не може да се логнете и пр.). Някои български сайтове с дълга съхранена история, които я пазят от десетилетия от началото на 2000-те, постепенно се обновяват и вече няма достъп. Напр. old.csd.bg - "Център за изследване на демокрацията", който работеше до 2020 г., когато ми трябваше една справка, но вече го няма, а Архив.орг пази само "фасади" от него.
Преди много години си замина bgit.net - един от първите български блогове и форум свързан с отворения код, Линукс и Ай Ти общността, не знам дали някой от създателите? му, сред които Йовко Ламбрев и Владимир Джувинов, още пазят архив; при мен останаха копия на отделни мои статии. В Архив.орг има фрагменти от него, най-старото копие е от юни 2001 г., когато изглежда е отворен сайтът: https://web.archive.org/web/20010630201813/http://www.bgit.net/).
Наскоро обаче самият Архив.орг* не беше достъпен в България за известно време. И т.н.
http://arxiv.org (сравни с http://archive.org) също е важен сайт, специализиран за публикуване на научни статии, който също подлежи на запазване в библиотека, както и разбира се Stackoverflow и сродните му, Github и пр.
...
Освен за да не се случи същото и със спомените от по-късния и съвременния Интернет заради затваряне на сайтовете, би било здравословно да има и местна сигурност в случай на прекъсване на достъпа до световния Интернет или част от него, което изглежда възможно предвид колко лесно се въвеждат всякакви "санкции" и ограничения както в т.нар. "свободен и демократичен" свят, според господстващите в България големи медии, така и в "противоположния" според "свободните" свят на "тирани, диктатори" и пр. Всеки блокира по нещо.
За по-голяма сигурност може да се запазват част от глобалните ресурси - разбира се, не може да се съхрани целият Интернет, но може да се запазят "важни", често ползвани и до определена дълбочина или някои да се съхраняват с известна компресия/частично и т.н.
Част от системата би могла да работи и като наблюдател на съдържанието на медиите и да извършва "media/press clipping", с която да има достъп и да се прави анализ на съдържанието на новинарски сайтове и страници на медии, социалните мрежи, на сайтовете за видеосподеляне по всякакви показатели - не пълно копие на видеофайловете, най-вече метаинформация; някои видеоклипове с по-ниска разделителна способност, само звук и пр.; транскрипция, както и описание на съдържанието на клипа чрез разпознаване на образи и класификация: описание какво се вижда на кадрите, какво се извършва и т.н.; отделни кадри (напр. ключовите кадри от видеото), схематична информация - компресирани кадри с приложени ефекти за откриване на очертания, текст извлечен с оптическо-разпознаване на символи и пр. Чрез новите технологии за пораждане на изображение като Stable Diffusion, Imagen, DALLE-2 и пр., и чрез идващите в бъдеще, ще може да се възстановява съществената част от съдържанието на медиите и от много по-малък обем компресирана информация.
Върху тези данни от медиите ще се правят различни справки и сравнения*; тази функция, както и цялостното събиране на данните, може да е основа и на експерименти с големи езикови модели в обработката на естествен език (NLP) и въобще изкуствения интелект, включително Общ ИИ.
За някои други приложения, свързани с почтеността на медии, политици и пр. виж в бележките по-долу.
Разбира се, системата може да бъде и търсачка, портал и пр. и като цяло би представлявало своеобразна разширена "енциклопедия".
Логично продължение е и разпределена българска социална мрежа и система за видеосподеляне с отворен код.
Като цяло:
Създаване на независим "български Интернет", който да позволи да се води "пълноценен мрежов живот" дори и ако по някаква причина международният Интернет се прекъсне.**
България всъщност има опит в това още от началото на 2000-те години от времето на free.techno-link и пр. с "Българския пръстен", в който имаше високоскоростна свързаност до някои ресурси в града или в страната във времена, в които все още се ползваше Интернет по телефона по 33.6 - 56.6 Кбит.
...
Как да работи архивът?
Разпределено съхранение на потребителски компютри
Основен сървър/сървъри, които с паяци обхождат мрежата и качват данните като торенти, потребителите също могат да добавят елементи както в Архив.орг.
Клиентските компютри имат приложение с отворен код, за да няма съмнения какво върши, в което потребителите решават какъв обем и трафик да заделят. Клиентското приложение може да извършва и част от изчислителната работа в разпределен режим, отново в дял, преценен от потребителя - подобно на някогашните "SETI @ Home" за анализ на сигнали от космоса, подобни системи в медицината като "Folding@home" и пр.
Приложението тегли част от файловете през торентите* и пр. и ги съхранява на потребителските компютри. Част от клиентите могат да бъдат институции, компании и пр., които "даряват" значителен обем памет, терабайти и пр.
Сървъри
Съхранението на данните и централизирано в сървъри, на поне няколко огледала, също е препоръчително.
Спасяване на стар софтуер и данни от лични архиви
Част от информацията, която вече не се открива в Интернет, може да е запазена в лични архиви, на компакт-дискове и пр. и да бъде възстановена от потребителите.
Ако например търсите определни безплатни програми от миналото, които не откривате - може да го зададаете като въпрос ("issue") в този проект.
Как да се осъществи?
Програмната и организационна част - като проект/множество от проекти с отворен код, които да се разработят от български програмисти, компании и пр. Ако проектът потръгне вероятно е разумно да се създаде ДНЦ (Дружество с нестопанска цел), но като за начало мисля, че това е излишно усложнение. Засега е достатъчно да се намерят желаещи, които да започнат от някъде, с някакъв пробен паяк и да общуват помежду си. Други желаещи могат по някакъв начин да дарят техника, като виртуални машини или физически, дисково пространство и пр.
** Благодарности на Bogo4, който ми писа днес за да ме пита за игра, която търсел, която вече била неоткриваема в Интерент, но снимка от нея има в една статия от сп. "Свещеният сметач", бр. 27 от 2003 г., "Упадъкът на езика на българското общество": http://eim.twenkid.com/old/3/27/upad.htmhttp://eim.twenkid.com/old/3/27/mar.gif
Играта е "Mario Warcraft", създадена с Game Maker. Благодаря също на Voltigore, който наскоро беше забелязал, че Archive.org не се е отварял и така също ми припомни идеята и необходимостта от български архив.
Бележки за допълнителни приложения
** Частични архиви за Интернет и др.
Разбира се, "Читанка" ("Моята библиотека") за книги, която в началото изглежда продължи по-старата библиотека sf.ludost.net. "Сандъците" и преди него един мой сайт за "прослава на българските сметачи" от 2002 г.: http://bulgariancomputers.freeservers.com/), Download.bg - което още работи; копията на списание "Свещеният сметач", също пазят паметници и "вкаменелости" от Интернет пространството в началото на 2000-те; "лафчето" на dir.bg още съществува и др.
Други функции за разнообразяване и проследяване на източниците: модерни са услугите за "борба с фалшивите новини" или с "пропагандата", в която обаче обикновено, разбира се, липсва борба с "институционализираната" или "собствената" пропаганда - онази, която управлява основните медии и има най-много пари. Например може да се сравнява съдържанието на различни медии и да се открие, че всички препредават едно и също и че всички техни журналисти и гости споделят и защитават една и съща позиция и противниците им са "наказвани" по един и същи начин или не са канени въобще - това противоречи на основните правила за "плурализъм" и за предаване на "всички гледни точки", за които уж се бореше "демокрацията". Необходима е диверсификация не само на енергоносителите, но и на медийната и културно-идеологическата зависимост на България.
Може да се провери и "прояви" по обективен начин например, че източникът на информацията за основните българоезични медии са да речем британски (виж едно събитие в Англия от осми септември и как беше отразено в България, сякаш България е колония на Британската империя, оплакваща своята кралица, а впоследствие възхваляващия новия крал), определени американски медии - или пък съответно руски и пр., т.е. дадени медии по съдържание всъщност са "ретранслатори" или "радиоточки" на тези медии майки, като повечето от тях са на запад от София и също разпространяват "пропаганда", т.е. тенденциозно поднесена информация, често с полуистини, скриване на неудобни факти, които са известни, преувеличения, изкривявания и пр.
Потребителите на медии имат право да знаят какъв е източникът и чии интереси и стратегии защитават дадени медии и да решат дали при тези обстоятелства медията заслужава вниманието и доверието им. Може да се извършва автоматичен анализ на настроенията и нагласите в медията (вид "Sentiment analysis"). Настроенията обикновено се припокриват с "медиите" майки (чия пропаганда) - дали са "крайно про-европейски, про-руски, про-американски, про-британски" или пък уравновесени; какви позиции представят с каква оценка, какви гости канят с какви позиции и всякакви параметри, какъв стил на изказване и пр. Кой какви грантове е получавал, с кого е свързано дадено публично лице и т.н., така че да се знае. Тези конкретни явления са видими и с просто око за онези, които наблюдават медиите и сравняват "на ум", но чрез подобна система мерките ще станат по-обективни и лесни за наблюдение и от неспециалисти.
** Проверката на "фалшивите новини", или по-точно дезинформацията, и склонността на дадена медия, източник и пр. да злоупотребява с такава, всъщност за някои случаи може да се извършва ефективно не в момента на публикуване, а впоследствие, след като се натрупа достатъчно историческа информация - мине време и може да се провери и от други източници и след други събития, че дадено твърдение или информация не са било вярно отразени. Натрупването на история на новините, изказванията, и след обработката - съответните дела, нагласи и пр. - би било полезно за тази цел, и може да бъде материал, набор данни на нови специални модели за машинно обучение. Всички проверки на "фалшиви новини" обаче трябва да вървят с предупреждение, че проверката и данните ѝ също може да са погрешни или едностранчива и човек трябва да преценява и да мисли и със собствената си глава, и никога да не се предоверява.
** Друго приложение е за проверка на обещанията и изказванията на политици и пр.* (мисля, че излезе някакво мобилно приложение за търсене в стенограмите на парламента?)
** Една друга идея, донякъде свързана с горните, е предложението на Разумир за Явно гласуване на избори за обществени длъжности с непрекъснато отброяване на резултатите в реално време и с потвърждения за всеки, че гласът му е отчетен правилно и непрекъсната проверка от всички гласуващи. По този начин фалшификациите при преброяването ще станат невъзможни. https://web.archive.org/web/20170115121036/http://narodovlastie.twenkid.com/
...
Bulgarian-Internet-Archive
Bulgarian Internet Archive Project - Preserve Data and Knowledge from the Local and Global Network
Drone Rider - a drone interface & simulator game @ Plovdiv Game Jam 2022 hackathon. Developed in Rust with Bevy engine by Lachezar and Todor. Features also Gazebo simulator, running with docker-compose (Docker Desktop on Windows), MAVSDK for communication with the drone. The POC was tested both on Linux and Windows.
More and the project:
https://github.com/Twenkid/PlovdivGameJam2022
Видеото е с български звук. Най-общо въведение и представяне на програмата Twenkid FX Studio Alpha 0.1 - издание от декември 2021 г. Twenkid Studio е може би единственият ютюб канал, който си има собствена програма за монтаж и визуални ефекти.
Тя е може би най-компактната система с подобни възможности - инсталационният файл е само 300 КБ, ръководството е 2 МБ заради многото снимки.
Следват продължения с подробно ръководство за употреба, уроци и пр. Засега: инфо, ръководство (на английски) и изтегляне на програмата:
http://twenkid.com/fx
https://github.com/Twenkid/Twenkid-FX-Studio/
Ако харесвате канала, подкрепете го като се абонирате, споделяте, коментирате, харесвате!
The movie is a sweet impressionistic story about the life of a cat "pride" just before, during and just after a short summer storm: what they do, where and how they hide, how they evade the drops, how they fight and rest etc.
The VFX was unnoticeable by a test viewer (just one though) and is blending well with the painting-like aesthetics of the shot, although it is far from perfect.
In short: A small and smart programmatic trick for removing an unwanted logo from a difficult and highly zoomed-in unstable shot during a hard rain.
In more details:
* A shot with a big zoom, filmed with an unstable camera and somewhat noisy picture during hard rain, where the individual drops are seen. What was the goal of the effect? Using a simple-enough to develop smart method which automatically removes an unwanted logo of a supermarket, which is constantly being crossed by the drops. The retouched shot shouldn't look unnatural and the drops should be preserved, i.e. the dynamics and look and feel of the drops have to be preserved.
The making of the shot shouldn't take too much time, because it was only one shot, less than 3 seconds long, and there were 11 other episodes from the "first run" of that series. Yet I didn't want to scrap the shot, because, aside from the logo, the rest of the image was picturesque and interesting.
I coded the effect in Python with OpenCV, where technically the latter served only as a video and image interface for I/O, because the processing is "manual": the image is accessed "pixel by pixel", not with some specific cv2 methods. As an idea it was inspired by VFX I developed for my 2018 fantasy "muscle art" and nature music video suite "Star Symphony in Chepelare", most of which was a VFX and had a cartoon-like look of a painting.
An alternative: if it was not raining and if the camera/shot were stable, the frame could be painted by hand by rotoscoping with GIMP or Photoshop once and then the painting be multiplied in the subsequent frames. The scene wouldn't be so interesting, though.
Note: The masked logo could be shaded a bit lighter, in order to match the shade of the supermarket façade, however as it was painted it is also reasonable, as it appeared like a continuation of the metal column.
Видео с обяснение на ефекта от клипа "Сън в летен дъжд" (2019).
* Цел на ефекта: видео с голямо увеличение, заснето с нестабилна камера от ръка, с шумна картина в пороен дъжд, при което се виждат отделните капки. По хитър прост начин автоматично да се заличи нежелано лого на верига магазини (постоянно пресичано от капките дъжд), като ефектът да не изглежда неестествено и се запазят дъждовните капки.
-- Използван в епизода "Сън в летен дъжд" от поредицата "Дивия Пловдив".
Coded: 28.11.2019 - 29.11.2019 in Plovdiv, Bulgaria (и малко промени около 16-17.9)
Трябваше да стане по-хитър начин и задоволително добре, не беше нужно да е съвършено, защото беше само един кадър от 3 секунди и не можеше да се занимавам прекалено дълго само с него. В същото време исках да използвам кадъра, защото имах нужда да разнообразя монтажа и защото картината, освен нежеланото лого, беше живописна и интересна.
Програмирах го на "Python" с OpenCV, като OpenCV служи само като видео интерфейс, обработката е "ръчна" - пиксел по пиксел.
Ако не валеше дъжд и камерата беше стабилна, можеше да се нарисува с "GIMP" или Photoshop веднъж и да се размножи в кадрите, но тогава сцената нямаше да е толкова интересно. С постоянно променяща се позиция и капки дъжд, беше непосилно да се нарисува 83 пъти, затова трябваше да се програмира.
...
Бел: Да, маскираното лого можеше да бъде по-светло (като ламарината на магазина), но така пък изглежда като продължение на металния стълб. По-светло - в следваща версия.
Python, OpenCV
PURPOSE: Automatically remove a logo in shaky, rainy, noisy video and preserve the raindrops crossing the logo
https://youtu.be/OWI7HQWyZWg
Модернизиран графичен вид на плъзгачите и бутоните
Балончета с подсказки (tooltips) на лентата с инструменти
Отваряне на папката с mp3-записи на синтезиран говор
Още рамки
Сравнение на плъзгачите във версии 2.04 и 2.03
Може би ще пусна два варианта, на някои може да им харесва повече по-"ретро" вида (стил ~Windows 98).
Тулбарът в новия стил например е плосък в основно състояние, в 2.03 е по-релефен и по-приятен - поне с тези икони, които нарисувах засега; те са плоски и имат нужда от рамки и ръбове, за да изпъкнат по-ясно...
Идеята на плоския дизайн на тези контроли в Windows XP без тези ръбове явно е да подхожда на по-изпипани пълноцветни икони с преливания и светлосенки. Ами да, по-красиво ще е, може и да порисувам в по-професионален стил, но това не е критично и ще почака.
Предварителни заявки за стандартната комерсиална версия
Горе-долу вече съм доволен от вида на интерфейса. Имам още работа по говорещата и анализиращата част, още диалози за правене, но вече приканвам тези, които очакват излизането на продукта да направят предварителни заявки за комерсиалната версия.
Засега ще е неформално, не ви ангажира с покупка, но ще се възползвате от промоционална цена, и ще покажете подкрепата си за проекта.
Вече има една предварителна заявка от И.Г. Благодаря ти! :)
Цена?
Стандартна модификация при предварителна заявка: 25 лв
[За сравнение, конкурентен продукт се предлага за около 80 лв в най-евтината си версия, а има и версии за двойно и тройно по-висока цена. Друг конкурентен продукт се продаваше за 20 лв през 2004 г., при средна заплата близо 3 пъти по-ниска от сега и след солидно външно субсидиране и финансиране. ]
Засега ми пишете на: twenkid - at - gmail - dot - com, ще се свържа с вас по-късно. Стандартната модификация ще има най-важните потребителски функции, с изключение на някои по-авангардни настройки и др., които ще са в "Про- версия".
Ще е възможно да се прави надграждане към по-горен клас модификация.
Тези които са закупили приложението с предварителна заявки ще ползват намаления след това.
Имайте предвид също, че след като закупите лиценз, ще получавате и всички обновления за съответното поколение продукт - ако закупите още сега версия 2.04 Алфа, ще имате лиценз за всички версии до 2.499 или 2.99* - и ще ми помогнете да създам тези по-горни версии.
Предвид, че това е основополагащ комерсиален продукт, първите, които са го закупили и са ме подкрепили, вероятно ще получат намаления и за други продукти.
За информация, ако съм жив и здрав и работата върви, до края на годината може да издам и десетина най-различни продукти. Зависи и как ги комплектовам, защото някои са пакети.
...
* Според начина на номериране - възможно е 2.5 - 2.6 да са някакви междинни версии към следващо поколение продукт.
Мобилна версия на "Тошко 2"
Както бях споменал още в началните анонси, планирам да създам и мобилна версия, но кога точно ще стане зависи от подкрепата на потребителите. Първата платформа вероятно ще бъде Android, защото вече внедрих технологията за разработка и придобих основните умения експерсно, само трябва да се захвана. Ако има достатъчно приходи, ще помисля и за iOS.
Закупилите настолната версия ще се възползват или от намаление, или от безплатен лиценз и за мобилната (или някоя от мобилните версии) - може да е нещо като "ваучер за намаление" и да си избират. Може да е ваучер за някое друго приложение.
Детайлите ще се изяснят, когато пренеса системата и на мобилни устройства и реализирам и тези други приложения - и мобилни, и настолни.
Дарения?
Заповядайте - само да кажете. :)
Приемат се всякакви суми. Засега се свържете с мен: twenkid -- at -- gmail -- dot -- com, ще оставя и други координати по-нататък, и по-лесен начин, вероятно страничка за цъкане към epay.
Благодетелите ще получат уважение и споменаване в кредитите на приложението и ще бъдат цитирани както те посочат (ако желаят, могат да останат и анонимни). :) Виж повече "Въпроси и отговори" на: http://twenkid.com/software/toshko2/
Все още не са реализирани всички от функциите и диалозите, изнесени на тулбара. Пресетите са почти готови - позволяват съхраняване и възстановяване на настройки на гласа.
Програмата със сигурност работи и на Windows XP (тествана е на Windows 7 и на XP). Вероятно ще работи и на 2000, но не е тествана. По принцип би могла да се компилира и за Win 98 (но ще трябва специално да го направя с друг компилатор).
Напоследък се занимавам повече с други неща и изследване и проектиране на технологии, които ще ускорят впоследствие разработката.
Предполагам, че този месец ще събера време да доведа Т.2 до състояние в което да съм склонен да пусна и бета версия (с повече потребители).
*Досега спирането беше с до няколко секунди закъснение, докато си свърши изказа)
** Още не съм внедрил гъвкавата система, с която ще разгърна напълно интонациите
Засега е достъпно само за едноцифрен брой потребители и не съм доволен от това, че най-съществените функции още не са готови както ги искам, но началото се забави достатъчно и исках вече да го поставя.
В предният пост споменавам за тактическите отклонения, предстои реализацията на практика на едно от тях, което да ускори довеждането на продукта до комерсиално издание и по-лесно довършване на тези функции, евентуално и до създаването на един друг продукт. (За съжаление не мога да споделя подробности.)
Благодарности на първите потребители!
English: It's premature and available only to a handful of users yet. I'm about to embark an interesting... software-architectural "digression" (as I mentioned) in order to boost the development of this and other products, but that's a story for a later time and hopefully a product on its own. Stay tuned. :)
(For English: see below) За хората, които чакат да излезе "Тошко 2" - тактическите краткосрочни задачи леко се изместиха към бързо внедряване и проучване на възможностите на технологии, които са били отлагани, а ми трябват за да мога по-бързо да доразработя и променям "Тошко 2" и следващите, а също и в помощ на други по-универсални приложения, напр. филмовия софтуер, който ще ми трябва за рекламата... :) Успехът в дългосрочната стратегия понякога изисква гъвкава краткосрочна тактика и привидно отстъпление, за да последва по-мощно нападение! :)
Конкретно за синтеза на звук в "Тошко 2" тази новоотключена мощ не е наложителна пряко, при един от тестовете той синтезира близо 30 минути говор и паралелно го записваше на твърдия диск за около 2 секунди (70-тина МБ звук), като работи в една нишка. В крайната версия ще прави малко повече сметки, но те са незначителни на фона на тази чудовищна бързина. Някои от тези технологии обаче ще ускорят оставащите детайли от разработката на едни функции, които изискват по-специални технологии за въвеждане на данни.
Не мога да разкрия конкретни детайли за приложенията на технологиите, но напр. най-накрая експресно внедрих употребата на мощни векторни инструкции SSE - до версия SSSE3*, SSE-то вече започна да ми служи добре като ускори няколко пъти операция, която е основа в една друга нишка от изследвания.
Внедрявам и употребата на модерно** GPGPU (впрягане на видеокартата за произволни сметки), което ще е още по-чутовно ускорение дори и на най-скромните видеокарти, които поддържат технологията. Това ми трябва за видео софтуера и за други по-авангардни неща.
И др. по-абстрактни и неочевидни ускоряващи неща в други насоки, които обаче са тайна засега.
*Яд ме е, че досега не съм го бил направил на практика, при положение че съм програмирал на машинен език и сам съм си смятал адреси на ръка и помнил кодове на инструкции от рода на A9 20 8D 40 40 още от невръстна възраст. Проучих и по-новите разширения на инструкциите, които мога да доведат ускорение още няколко пъти със SSE4 (с неорязано Core 2 Duo), и после още два пъти с AVX (Core i Sandy Bridge и следващите), но имам нужда от нова работна станция, за да мога да ги използвам.
** Защото имам опит с ранното GPGPU с пикселшейдъри под Direct3D9, когато данните се пращаха и четяха само през текстури или като геометрия. Това беше още ps2.0, но тогава ограниченията бяха много досадни.
"Булдозерите" на AMD също имат интересни инструкции в SSE4a за бреоене на битове и водещи нули - малко тъпо е, че Интел ги нямат.
... High Performance Computing
I've become a SSE developer already, I need it to boost the performance and it started serving already! :)
GPGPU acceleration is also being hacked, to push my technology to the next performance level, and for my movie making software. I'm also developing other technologies waiting in a queue from a long time, now getting served...
"Toshko 2" completion and release is postponed a bit due to the digression.
Тази седмица фокусът по "Тошко 2" е довършване на някои от основните нови говорни функции, и един крайъгълен камък, засягащ цялата екосистема - поставям основите на инфраструктурата на моя "облак" и клъстер.
Комуникационна инфраструктура ще свързва различните приложения в разнородна среда, част от това е и изграждане на основна архитектура за лесно разширение на функциите на всяко от приложенията:
чрез извикване на други програми
чрез плъгини и допълнителни библиотеки, които могат да бъдат създавани и от други разработчици, след като оформя и публикувам интерфейс за връзка,
Тук може да се събере някакво неформална група заинтересувани, с които да заченем стандарти. Честно казано съмнявам се да намеря хора за тази група на този етап, сигурно докато успея, вече ще съм сглобил първите версии на стандартите и ще съм ги приложил, но ако някой има желание - да се обажда.
Към съобщителната инфраструктура влиза и първична система за логване и регистрация, преди да пусна алфата за ползване от първите тестери.
Приложенията от екосистемата ми за PC засега ще са написани и отворени към директно взаимодействие чрез C/C++, Java, вероятно и C# под Windows и Linux*, с преход и към мобилни ОС (за начало Андроид). Интерфейсът ще има и платформено-независим протокол през уеб/сокети и др.
Ще има и уеб-сървърна част за някои нужди, към момента PHP и може би Java, и въпросните настолни и мобилни приложения ще общуват и с нея - например за логването.
Идеята е всички приложения от цялото множество да могат свободно да взаимодействат, независимо на каква платформа работят.
* В началото преобладаващо Windows
......
Думи: хетерогенна, разнородна, Ineter-Process Communication, IPC, Cloud computing, HTTP, уеб приложения, мобилни приложения, Тошко 2, Тошко 2.01, синтезатор на реч, говореща програма, говоряща програма, говор, разпознаване на реч, TTS, STT, Speеch to text
Знам, искате да чуете демо или да пробвате програмата сами, но засега не може. :P
Ще има когато преценя, че достатъчна част от функциите стават за потребители, били и тестери. Имам да решавам и други, не синтезаторни проблеми.
Разработвам разни инструменти, замислени преди 100 години, които ще подробят този синтезатор и ми трябват за следващото поколение, както и за системата за филмопроизводство Twenkid FX Studio, която също чака на опашка да я направя на продукт.
Тя е пренебрегната и самотна :), но ще я удостоя с внимание, защото ми е нужна, за да реализирам рекламата - хрумнаха ми някои шантави идеи и репетирах малко вчера-завчера. :D
"Тошко II" има нужда и от модули за връзка с други приложения и с Интернет, архитектура за разширяване на функциите и добавяне на интелигентност (съществена част малко по-нататък!), от защита на интелектуалната собственост, от измисляне на варианти за демо версии и пълна версия, различни окомплектовки, възможности за настройки, интерфейс и др. Работа - бол.
Между другото имам належаща работа и по други технически въпроси, като това че трябва да се ориентирам и в мобилната разработка, и няма кой да ми направи сайтовете по-динамични и "живи". Те също, горките, са пренебрегвани, и ударно ще трябва да свърша и малко такава работа.
Разбира се, винаги на дневен ред са изследователски неща от по-фундаменталните насоки и безкрайните идеи, при които закъснението може да е фатално - зарекъл съм се до края на годината да съм създал поне първи прототип на моя мислеща машина.
И други софтуерни чакащи задачи, някои от тях много важни за продуктивността ми по всички останали... И останалите 1000 неща, за които не стига времето...
Отзиви на зрители:
1. :D
2. Ха-ха-ха, това което си направил е доста интересно! :D
3. Много е сладко филмчето! :)
4. Супер се е получило! :) :D //Мнение на магистър по кинокритика.
5. Супер е!
6. Луд за връзване! :)
7. Дюк Нюкъм ли чух?
8. (...) хахаха!
Въпреки всички задачи обаче, "Тошко 2" идва скоро! :P
...
"Тошко 2"е начало на поредица от приложения от цяла софтуерна екосистема, която се надявам да успея да разгърна още през тази година.
Самата втора версия на синтезатора на българска реч ("говореща програма", "говореща компютърна програма") е загрявка за по-горните версии от планираното развитие на проекта. Версия 3, 4 и евентуално 5 ще използват по-мощни и гъвкави архитектури - може би на няколко пъти ще има промяна, или ще се добавят алтернативни архитектури, които ще се включват по желание. (7)
По-късно ще ви покажа примерни приложения, за които аз самият използвам оригиналната версия и друг синтезатор на английски, и ще използвам новия ми софтуер, за да го правя по-добре и във все повече случаи.
Сравнение между "Тошко 2" и "Глас" ("Глас 2004") - един най-добрите ми продукти от тийнейджърската юнашка ера (6), комбинация от "Писар" (2002-2004) и "Глас" (2004)
Глас (Глас 2004, Писар-Глас 2004)
Тошко 2 (Глас 2, Глас 2013)
Хибриден микрофонемно-формантен синтезатор със синтез на плавен преход - позволява гладък говор без досадните насичания на синтезаторите със слепване, голяма гъвкавост при настройката на параметрите му и изключително компактни размери и малко използвана памет. (4)
Усъвършенстван хибриден микрофонемно-формантен синтезатор - все още с изключително компактни размери. (4)
Съобразява се с правилата за правоговор и фонетични изменения в българския език.
Съобразява се с правилата за правоговор и фонетични изменения в българския език.
Може да изгоравя ударени и затъмнени гласни, но трябва да се отбележат ръчно в текста.
Автоматично поставя ударения и по-добрe моделира ударени и неударени гласни. (1)
Настройка на скорост, височина (в "Глас" наречена "тембър" - дебел или тънък глас), преход и др., чрез избор на готови стойности от падащо меню.
По-удобен интерфейс за бърза настройка с плъзгачи.
Може да се променя само дължината на гласните.
Промяна на дължината и на съгласните.
Промяната на височината ("тембъра") е само по един начин.
По-богати възможности за промяна на тембъра и по-разнообразни гласове.(2)
Монотонен говор.
Автоматична интонация според текста и възможност за ръчно задаване на интонация. (1)
Няма динамика на вокалната енергия.
Динамика на вокалната енергия.
Може да запише изговореното в некомпресиран файл за слушане без програмата (PCM, WAV). (3)
Може да записва в некомпресиран файл и в MP3 и др., и ще е видима функция.
Работи и под Linux с емулатора Wine.
Ще се стремя да запазя този принцип.
Работи с ANSI текст - еднобайтови символи, Windows-1251. Mоже да импортира и МИК (ДОС-овска). Win-1251 понякога създава проблеми под Linux, който използва UNICODE.
Работи и с UTF-8 UNICODE текст.
Може да прочита някои съкращения, цифри - разширява се от потребителя от конфигурационен файл.
Разширени функции за прочитане на числа, дати, някои думи на английски и др. (1)
X1
X1 - Тайна! Очаквайте като излезе
Промените на настройките стават само в диалогов режим през графичния интерфейс.
Настройките ще могат да се задават със скрипт в самия текст или отделно - за по-изразително четене с подсилена интонация, промяна на темпото на говор, паузи и пр.
X2
X2 - Тайна! Очаквайте като излезе
...
И др. изненади, и допълнения по желание на потребителите!
(1) - Обхватът и точността на тези функции ще се разширява с времето и междинните версии. Вероятно ще създам платформа, с която потребителите да маркират ударения и да обучават системата, да се добавят примери със съкращения и изговор др.
(2) - Някои функции може и да не са налични веднага в първата публикувана алфа версия.
(3) - Имаше запис на говора във файл за вътрешни нужди, но включването му ставаше чрез конфигурационния файл и не беше упоменато как става. :)
(4) - Обвивката на "Глас" беше текстовият ми микро-редактор "Писар", изестен в Download.BG по онова време като "Българският Notepad" - макар че беше по-мощен от Notepad, въпреки изключително компактния изпълним файл, писан на Си. Компресираният .zip пакет на "Глас 2004" заемаше само 173 КБ, използваше около 2 МБ памет, основно буфер за изговореното, като това можеше да се настройва в конфигурацията и стойността по подразбиране беше излишно голяма. На практика можеше да работи и с няколкостотин КБ свободна оперативна памет под Windows 95, т.е. вероятно може да се пренесе и да работи нормално дори и на обикновен Java телефон от онези години - 2003-та, 2004-та...
(6) - Помните ли юнашката епоха :D, юнашкото наречие, юнашките разкази и стил? Вижте ДРУБЕ/ДЗБЕ в блога.
(7) Новите архитектури - мислил съм за този прогрес и писал още преди 9 години, докато създавах "Глас" на един дъх за 4-5 седмици, и по-късно преди 5 години през 2008 г., във връзка с магистърската ми дипломна работа, но все не им идва ред да ги реализирам. Надявам се вече да ги материализирам, но първо ще дооползотворя възможностите на тази архитектура и смятам да дам на потребителите полезен продукт. :)
Поредицата от нови архитектури - нещо подобно на това, което правят колегите от Intel през 2-3 години: tick-tock, нова микро-архитектура процесори. http://en.wikipedia.org/wiki/Intel_Tick-Tock