Dalawang taon na ang nakalipas, ang voice cloning ay nangangailangan ng napakaraming oras ng training audio at daan-daang libong dolyar sa compute. Ngayon, ang mga consumer services ay kayang magsynthesize ng isang kilalang boses mula sa limang minutong malinis na recordings. Ang bilis ng pagbabago sa AI-assisted memory preservation ay talagang nakakagulo — kahit para sa mga taong nagtatrabaho sa larangang ito.
Ito ay isang field report, hindi isang product review. Isa kami sa mga serbisyo na gumagana sa kategoryang ito, na nangangahulugang mayroon kaming malinaw na pananaw. Ang sinubukan naming isulat dito ay isang tapat na pagsusuri kung ano ang talagang umunlad, ano ang nananatiling mahirap, at ano ang mga umuusbong na tanong para sa mga pamilya na sumusubok na mag-navigate sa mga tool na ito.
Ano ang talagang umunlad mula 2024
Kalidad ng voice synthesis
Ang agwat sa pagitan ng synthetic at recorded voice ay lubos na bumaba. Noong 2023, ang mga AI-generated voices ay may katangiang flatness — isang compression ng emotional range na tila kakaiba sa mahabang pakikinig. Sa kalagitnaan ng 2025, ang mga modelo mula sa ElevenLabs, OpenAI, at ilang mas maliliit na provider ay nakabawas ng flatness sa puntong hindi na maaasahang makilala ng mga casual listeners ang synthesized voice mula sa isang tunay na boses sa maiikli na clips.
Ang mga implikasyon para sa alaala ng pamilya ay totoo. Ang isang voice model na itinayo mula sa mga recordings na ginawa ng iyong lolo sa edad na 75 ay maaari nang magbasa ng teksto, magkuwento ng mga caption sa mga larawan, o magdeliver ng sulat na isinulat ng kamay — sa paraang talagang tunog niya. Nariyan na ang teknolohiya. Ang mga tanong tungkol sa etika at pahintulot sa paggamit nito ay hindi pa nalulutas sa antas ng industriya, kahit na ang kakayahan ay umunlad na.
AI-assisted na estruktura ng alaala
Ang mga malalaking language models ay talagang naging kapaki-pakinabang sa estruktural na antas ng pagsusulat ng alaala. Sa mga raw transcripts mula sa mga recorded interviews, ang mga kasalukuyang modelo ay kayang ayusin ang mga fragment sa mga magkakaugnay na kwento, tukuyin ang mga tematikong linya, magmungkahi ng mga bridging passages, at ituro ang mga puwang sa kronolohiya. Ang hindi pa rin nila magawa ng maayos ay ang tiyak na detalye — ang pangalan ng bayan, ang eksaktong taon, ang paglalarawan kung ano ang amoy ng kusina — na tanging mula sa mismong paksa lamang maaaring makuha.
Ang praktikal na resulta: Ang AI ay ngayon isang kredibleng editing layer, hindi isang kapalit para sa orihinal na recording. Kung mayroon kang mga oras ng raw interview, makakatulong ang AI na hubugin ito sa isang bagay na mababasa. Hindi nito kayang imbentuhin ang wala.
Multimodal na preservation
Ang integrasyon ng boses, imahe, video, at teksto sa mga pinag-isang archive ay lubos na umunlad. Ang mga serbisyo na dati ay nag-iimbak ng media sa mga silo ay lumipat patungo sa mga naka-link na archive — ang isang recording ng iyong lola na nagsasalita tungkol sa isang litrato ay maaari nang itago upang ang litrato at ang recording ay lumabas nang sabay, na may kasamang transcript. Mukhang incremental ito. Para sa mga pamilya na humaharap sa malalaki, hindi organisadong archive, ito ay nakabago.
Ano ang hindi umunlad
Mga balangkas ng pahintulot
Ang pinakamalaking pagkaantala sa industriya ay hindi teknikal — ito ay etikal. Ang karamihan sa mga serbisyo na gumagana sa espasyong ito ay umaasa pa rin sa mga miyembro ng pamilya o mga estate upang pahintulutan ang voice cloning at posthumous na paggamit ng personal na data, sa halip na mula sa tahasang pahintulot ng mismong paksa. Ito ay hindi isang kritisismo sa anumang partikular na kumpanya. Ito ay isang obserbasyon tungkol sa isang norm na hindi pa nagbago sa kategoryang ito sa kabila ng pagtaas ng pampublikong kamalayan sa mga panganib.
Ang praktikal na bunga: kung gumagamit ka ng serbisyo na hindi nangangailangan ng sariling recorded consent ng paksa, ikaw ay gumagawa ng desisyon para sa isang tao na maaaring hindi siya sumang-ayon. Maaaring ayos lang ito sa iyong pamilya. Maaari rin itong magdulot ng hidwaan, pagkakasala, o mga legal na komplikasyon na hindi magiging maliwanag hanggang sa mga taon mamaya.
Hallucination sa conversational AI
Ang pinaka-k commercially exciting na kategorya — conversational AI na nakabatay sa mga recordings ng isang yumaong tao — ay siya ring may pinakamalaking hindi nalutas na problema. Ang mga LLM na nakakabit sa isang voice model ay lilikha ng mga plausible-sounding na sagot sa mga tanong na hindi kailanman tinugunan ng paksa. Ang output ay tunog tunay. Hindi ito tunay. Ito ay interpolation ng modelo sa kung ano ang maaaring sinabi ng paksa, na nakadamit sa boses ng paksa.
Para sa mga pamilya na nasa matinding pagdadalamhati, ang pagkakaiba ay talagang mahirap hawakan. Ilang peer-reviewed psychology studies na inilathala noong 2025 ay nagsimulang suriin ang mga implikasyon ng pagdadalamhati ng teknolohiyang ito, at ang mga paunang ebidensya ay nagpapahiwatig na ang conversational AI ancestors ay maaaring makasagabal sa halip na suportahan ang malusog na pagdadalamhati — partikular para sa mga bata at sa mga tao na may kumplikadong relasyon sa yumaong tao.
Hindi ito nalutas ng teknolohiya. Pinalakas nito ito.
Ang mga tanong na dapat itanong ng bawat pamilya bago pumili ng serbisyo
Anuman ang serbisyong iyong ginagamit — sa amin o sa iba — ito ang mga tanong na dapat magtakda kung pagtitiwalaan mo sila sa isang bagay na hindi mapapalitan:
- Sino ang pumayag? Ang paksa ba mismo ang nagpahintulot sa serbisyong ito, o may miyembro ng pamilya na nagdedesisyon para sa kanya?
- Ano ang mangyayari sa data kung ang kumpanya ay magsara o makuha? Ito ay isang startup-heavy na kategorya. Ang sagot na “wala pa kaming polisiya” ay hindi katanggap-tanggap.
- Ang mga output ng AI ba ay may label? Kapag ang isang bagay sa archive ay AI-generated kumpara sa direktang mula sa paksa, ito ba ay malinaw na nakatanda?
- Ginagamit ba ang voice model para sa anumang training data? Kahit na ang sagot ay “anonymized,” humingi ng mga detalye.
- Maaaring bawiin ng sinumang miyembro ng pamilya anumang oras? O kailangan bang umabot ng consensus ang pamilya — isang proseso na bumabagsak sa mga kumplikadong pamilya, na karamihan sa mga pamilya.
Saan namin iniisip na patungo ito
Patuloy na uunlad ang teknolohiya nang mas mabilis kaysa sa mga etikal na balangkas sa paligid nito. Iyan ang kalikasan ng kategoryang ito. Ang magtatangi sa mga serbisyo sa susunod na 24 na buwan ay hindi ang teknikal na kakayahan — kundi ang rigor ng consent at access architecture sa paligid ng kakayahan.
Ang mga pamilyang magiging pinaka-servisyo ng teknolohiyang ito ay ang mga nakakuha ng mga raw, tunay na recordings ng mga taong mahal nila habang ang mga taong iyon ay buhay pa — at gumagamit ng AI bilang tool upang ayusin at palawakin ang mga recordings na iyon, hindi bilang kapalit para sa mga ito.
Ang pinakamahalagang bagay na hindi kayang gawin ng AI ay palitan ang pag-uusap na hindi mo pa nagagawa. Pumunta ka at gawin ito.
“Ang teknolohiya ang madaling bahagi. Ang mahirap na bahagi ay ang pagtitiyak na ang tao ay nais na maalala sa ganitong paraan.”
— Dr. James Lury, University of Edinburgh, Digital Heritage Conference 2025
Itala ang kanilang boses bago ito mawala.
Simulan sa isang pag-uusap. Ang Heirloom ay gagabay sa iyo sa lahat ng iba pa — subukan ang libreng demo sa theheirloom.ai/try, walang kinakailangang credit card.
Subukan ang Libreng Demo →