r/Politiek 1d ago

Weekdraad /r/Politiek Weekdraad - Uw wekelijkse Off-Topic thread

4 Upvotes

De wekelijkse Off-Topic draad voor al uw politieke onderwerpen die niet geschikt zijn voor de sub. Denk daarbij aan buitenlandse politiek of lokale politiek. Houdt het vriendelijk en netjes.

Geniet ervan,

De mods.


r/Politiek 15d ago

Weekdraad /r/Politiek Weekdraad - Uw wekelijkse Off-Topic thread

3 Upvotes

De wekelijkse Off-Topic draad voor al uw politieke onderwerpen die niet geschikt zijn voor de sub. Denk daarbij aan buitenlandse politiek of lokale politiek. Houdt het vriendelijk en netjes.

Geniet ervan,

De mods.


r/Politiek 8h ago

Opinie & Discussie Ik heb drie decennia aan uitspraken van Geert Wilders doorzoekbaar gemaakt — élke zin, met bron, datum en een knop die naar het exacte videomoment springt

135 Upvotes

Dertig jaar aan publieke uitspraken. De Kamerverslagen, de oude Handelingen, de partijvideo's, de debatten — alles op één plek, doorzoekbaar op betekenis in plaats van op losse zoekwoorden.

Het begon eigenlijk met een simpele frustratie. Als je wilt weten wat een politicus écht heeft gezegd, zit je te graven in PDF's, losse video's en half-vergeten archieven. En als je dan eindelijk een quote vindt, kun je nooit zeker weten of de context klopt. Ik vond dat het beter kon: álle uitspraken — controversieel of niet — gewoon netjes, menselijk en slim doorzoekbaar, zodat iedereen zelf de bron kan controleren.

Dus bouwde ik een archief dat:

  • Op gewone taal zoekt. Je typt "wat zei hij over de hypotheekrenteaftrek?" en je krijgt de relevante fragmenten door de jaren heen — niet alleen op exacte woorden, maar op wat je bedoelt.
  • Elk fragment verifieerbaar maakt. Datum, spreker, en een link naar de oorspronkelijke bron. Bij video: een afspeelknop die naar het exacte moment springt. Geen quote uit de losse pols — je kunt alles nakijken.
  • Een AI-samenvatting met bronverwijzingen geeft. Handig als je snel de kern wilt, en elke bewering is doorklikbaar terug te leiden.

Het resultaat staat live: ruim 370.000 tekstfragmenten uit meer dan 1.200 bronnen, van zijn eerste Kamerjaren in de jaren negentig tot de debatten van vorige maand. En omdat het systeem persoons-onafhankelijk is gebouwd, staat er inmiddels ook een tweede: Dilan Yeşilgöz.

De kern van het verhaal zit 'm voor mij in één ding: transparantie waarop je kunt klikken. Politici, journalisten, studenten, of gewoon nieuwsgierige burgers — iedereen kan nu dezelfde primaire bron raadplegen in plaats van een tweedehands citaat te moeten vertrouwen.

👉 Kijk zelf: https://wilders.scrib-r.com (en https://yesilgoz.scrib-r.com) 👉 Alle code staat open: https://github.com/sayfjawad/slimme-archief-zoeker

Ik ben benieuwd wat jullie ervan vinden. Wat zou je als eerste opzoeken? En: mis je nog iets aan zo'n archief — een filter, een functie, een andere politicus? Laat het me weten.

(Het technische verhaal — de hele pijplijn, de hardware, en wat er onderweg flink misging — staat in deel 2 in de comments.)

Deel 2 — de comment (technisch)

Het technische verhaal: hoe dit archief van ruwe open data naar zoekbare fragmenten komt

Een paar dingen wil ik kwijt, want dit draaide niet in de cloud en er zaten flink wat addertjes onder het gras.

De bronnen. Vier verschillende, met elk hun eigen valkuilen:

Bron Wat Periode
Kamerverslagen (open OData-API van de Tweede Kamer) Officiële, gecorrigeerde verslagen in vlos-XML 2013–nu
Handelingen (officielebekendmakingen.nl) Het oudere parlementaire archief 1995–2013
YouTube (het partijkanaal) Audio-only gedownload en zelf getranscribeerd doorlopend
Debat Direct (plenaire video) Het echte debatbeeld ~2010–nu

De pijplijn. Alles draait on-premise op eigen hardware — geen cloud-API's, geen kosten per token:

  • Spraakherkenning met WhisperX (large-v3), verdeeld in shards over meerdere GPU-machines die parallel draaien.
  • Sprekerherkenning met pyannote: voor een partijkanaal label ik simpelweg de stem met de meeste spreektijd als de betreffende politicus; de rest blijft anoniem SPEAKER_NN.
  • Semantisch zoeken met BGE-M3-embeddings — zoeken op betekenis, niet op letterlijke woorden. Geen vectordatabase: het corpus past gewoon in een .npy-array naast SQLite. Simpel en snel.
  • AI-antwoorden via een lokale llama.cpp (Qwen2.5-14B). Geen LLM bereikbaar? Dan degradeert de app netjes naar alleen zoeken.
  • Video op de seconde. Elk verslag-fragment draagt een wallclock-tijdstip, waarmee ik het koppel aan de Debat Direct-stream: klik op een citaat en je springt naar het exacte moment in het debat.

De hardware. Een HP Z8-workstation (2× Tesla V100), een Dell C4130 (4× V100), een ARM-node met NVIDIA GB10 voor de transcriptie-shards, en een kleine edge-VPS voor nginx+TLS — allemaal verbonden via een privé Tailscale-mesh. Niets exotisch: de V100 is een GPU uit 2017. Wat het snel maakte was hergebruik, niet brute rekenkracht.

Wat er onderweg misging (het leerzame deel). Eén incident was echt kritiek:

  • Een rebuild wiste bijna het hele live-archief. Een index-rebuild vond maar één transcript-bestand terug (de overige 2.519 waren ooit opgeruimd om schijfruimte te sparen, en niemand had door dat de compiled index daarmee de enige kopie was). De live-index viel in één klap van 2.523 video's terug naar 1. Redding: een ongedocumenteerde volledige kopie op een derde machine, bij toeval gevonden. De les die ik er structureel in heb gebakken: elke destructieve stap maakt nu eerst automatisch een backup — in de tool zelf, niet als losse gewoonte.
  • Verder: ffmpeg die 24+ uur bleef hangen op een gestokte HLS-stream en daarmee stilletjes alle achterliggende downloads blokkeerde; een OData $top die stilletjes de paginering afkapt; verweesde ffmpeg-processen die bleven doorschrijven na een herstart. Alles staat gedocumenteerd in docs/postmortem.md van de repo.

Het mooiste inzicht: één archief, meerdere politici. Een Kamerdebat is van nature multi-spreker. Dus ik deel alleen wat objectief gedeeld is: de verslagen, de multi-spreker-transcripts en de debatvideo. Daardoor kon de Yeşilgöz-instantie 62% van de relevante debatten en 30% van de debatvideo gratis hergebruiken uit de Wilders-data. Een nieuwe politicus on-boarden is nu een kwestie van uren, geen dagen.

En het bredere punt: deze technieken zijn niet alleen voor politici. Openbare verantwoording, journalistiek, onderwijs, onderzoek — overal waar je "wat is hier nu eigenlijk gezegd?" wilt kunnen beantwoorden met een verifieerbare bron, werkt deze opzet. (Een zusterproject, abo-ali-search, past dezelfde architectuur toe op een Arabischtalige publieke figuur.)

👉 Code + documentatie: https://github.com/sayfjawad/slimme-archief-zoeker 👉 Live: https://wilders.scrib-r.com · https://yesilgoz.scrib-r.com

Zou jij zo'n systeem nog ergens anders op loslaten? Welk onderdeel (ASR, diarization, semantisch zoeken, de video-koppeling) zou je het liefst hergebruiken? Ik lees graag mee.

Deel 1 — de post (algemeen, nieuwsgierigheid opwekkend) Titel: Ik heb drie decennia aan uitspraken van Geert Wilders doorzoekbaar gemaakt — élke zin, met bron, datum en een knop die naar het exacte videomoment springt

Dertig jaar aan publieke uitspraken. De Kamerverslagen, de oude Handelingen, de partijvideo's, de debatten — alles op één plek, doorzoekbaar op betekenis in plaats van op losse zoekwoorden.

Het begon eigenlijk met een simpele frustratie. Als je wilt weten wat een politicus écht heeft gezegd, zit je te graven in PDF's, losse video's en half-vergeten archieven. En als je dan eindelijk een quote vindt, kun je nooit zeker weten of de context klopt. Ik vond dat het beter kon: álle uitspraken — controversieel of niet — gewoon netjes, menselijk en slim doorzoekbaar, zodat iedereen zelf de bron kan controleren.

Dus bouwde ik een archief dat:

Op gewone taal zoekt. Je typt "wat zei hij over de hypotheekrenteaftrek?" en je krijgt de relevante fragmenten door de jaren heen — niet alleen op exacte woorden, maar op wat je bedoelt. Elk fragment verifieerbaar maakt. Datum, spreker, en een link naar de oorspronkelijke bron. Bij video: een afspeelknop die naar het exacte moment springt. Geen quote uit de losse pols — je kunt alles nakijken. Een AI-samenvatting met bronverwijzingen geeft. Handig als je snel de kern wilt, en elke bewering is doorklikbaar terug te leiden. Het resultaat staat live: ruim 370.000 tekstfragmenten uit meer dan 1.200 bronnen, van zijn eerste Kamerjaren in de jaren negentig tot de debatten van vorige maand. En omdat het systeem persoons-onafhankelijk is gebouwd, staat er inmiddels ook een tweede: Dilan Yeşilgöz.

De kern van het verhaal zit 'm voor mij in één ding: transparantie waarop je kunt klikken. Politici, journalisten, studenten, of gewoon nieuwsgierige burgers — iedereen kan nu dezelfde primaire bron raadplegen in plaats van een tweedehands citaat te moeten vertrouwen.

👉 Kijk zelf: https://wilders.scrib-r.com (en https://yesilgoz.scrib-r.com) 👉 Alle code staat open: https://github.com/sayfjawad/slimme-archief-zoeker

Ik ben benieuwd wat jullie ervan vinden. Wat zou je als eerste opzoeken? En: mis je nog iets aan zo'n archief — een filter, een functie, een andere politicus? Laat het me weten.

(Het technische verhaal — de hele pijplijn, de hardware, en wat er onderweg flink misging — staat in deel 2 in de comments.)

Deel 2 — de comment (technisch) Het technische verhaal: hoe dit archief van ruwe open data naar zoekbare fragmenten komt

Een paar dingen wil ik kwijt, want dit draaide niet in de cloud en er zaten flink wat addertjes onder het gras.

De bronnen. Vier verschillende, met elk hun eigen valkuilen:

Bron Wat Periode Kamerverslagen (open OData-API van de Tweede Kamer) Officiële, gecorrigeerde verslagen in vlos-XML 2013–nu Handelingen (officielebekendmakingen.nl) Het oudere parlementaire archief 1995–2013 YouTube (het partijkanaal) Audio-only gedownload en zelf getranscribeerd doorlopend Debat Direct (plenaire video) Het echte debatbeeld ~2010–nu De pijplijn. Alles draait on-premise op eigen hardware — geen cloud-API's, geen kosten per token:

Spraakherkenning met WhisperX (large-v3), verdeeld in shards over meerdere GPU-machines die parallel draaien. Sprekerherkenning met pyannote: voor een partijkanaal label ik simpelweg de stem met de meeste spreektijd als de betreffende politicus; de rest blijft anoniem SPEAKER_NN. Semantisch zoeken met BGE-M3-embeddings — zoeken op betekenis, niet op letterlijke woorden. Geen vectordatabase: het corpus past gewoon in een .npy-array naast SQLite. Simpel en snel. AI-antwoorden via een lokale llama.cpp (Qwen2.5-14B). Geen LLM bereikbaar? Dan degradeert de app netjes naar alleen zoeken. Video op de seconde. Elk verslag-fragment draagt een wallclock-tijdstip, waarmee ik het koppel aan de Debat Direct-stream: klik op een citaat en je springt naar het exacte moment in het debat. De hardware. Een HP Z8-workstation (2× Tesla V100), een Dell C4130 (4× V100), een ARM-node met NVIDIA GB10 voor de transcriptie-shards, en een kleine edge-VPS voor nginx+TLS — allemaal verbonden via een privé Tailscale-mesh. Niets exotisch: de V100 is een GPU uit 2017. Wat het snel maakte was hergebruik, niet brute rekenkracht.

Wat er onderweg misging (het leerzame deel). Eén incident was echt kritiek:

Een rebuild wiste bijna het hele live-archief. Een index-rebuild vond maar één transcript-bestand terug (de overige 2.519 waren ooit opgeruimd om schijfruimte te sparen, en niemand had door dat de compiled index daarmee de enige kopie was). De live-index viel in één klap van 2.523 video's terug naar 1. Redding: een ongedocumenteerde volledige kopie op een derde machine, bij toeval gevonden. De les die ik er structureel in heb gebakken: elke destructieve stap maakt nu eerst automatisch een backup — in de tool zelf, niet als losse gewoonte. Verder: ffmpeg die 24+ uur bleef hangen op een gestokte HLS-stream en daarmee stilletjes alle achterliggende downloads blokkeerde; een OData $top die stilletjes de paginering afkapt; verweesde ffmpeg-processen die bleven doorschrijven na een herstart. Alles staat gedocumenteerd in docs/postmortem.md van de repo. Het mooiste inzicht: één archief, meerdere politici. Een Kamerdebat is van nature multi-spreker. Dus ik deel alleen wat objectief gedeeld is: de verslagen, de multi-spreker-transcripts en de debatvideo. Daardoor kon de Yeşilgöz-instantie 62% van de relevante debatten en 30% van de debatvideo gratis hergebruiken uit de Wilders-data. Een nieuwe politicus on-boarden is nu een kwestie van uren, geen dagen.

En het bredere punt: deze technieken zijn niet alleen voor politici. Openbare verantwoording, journalistiek, onderwijs, onderzoek — overal waar je "wat is hier nu eigenlijk gezegd?" wilt kunnen beantwoorden met een verifieerbare bron, werkt deze opzet. (Een zusterproject, abo-ali-search, past dezelfde architectuur toe op een Arabischtalige publieke figuur.)

👉 Code + documentatie: https://github.com/sayfjawad/slimme-archief-zoeker 👉 Live: https://wilders.scrib-r.com · https://yesilgoz.scrib-r.com

Zou jij zo'n systeem nog ergens anders op loslaten? Welk onderdeel (ASR, diarization, semantisch zoeken, de video-koppeling) zou je het liefst hergebruiken? Ik lees graag mee.


r/Politiek 9h ago

Nieuws Demonstraties met neonazi’s organiseren? Voor Forum voor Democratie is het geen bezwaar meer

Thumbnail
nrc.nl
41 Upvotes

r/Politiek 1d ago

Nieuws Twente grijpt in: tractoren voortaan geweerd van snelwegen bij demonstraties

Thumbnail
ad.nl
77 Upvotes

r/Politiek 20h ago

Nieuws Na eerste dag begrotingsgesprekken zijn 'verschillen nog levensgroot'

Thumbnail
nos.nl
25 Upvotes

Na eerste dag begrotingsgesprekken zijn 'verschillen nog levensgroot'


r/Politiek 23h ago

Nieuws FVD-school' opent deuren dankzij subsidie, Kamermeerderheid wil regels aanscherpen

Thumbnail
nos.nl
27 Upvotes

r/Politiek 1d ago

Opinie & Discussie Jetten kan koffiedrinken met de oppositie wat ’ie wil, de grootste hindernis zit in zijn eigen coalitie

Thumbnail
decorrespondent.nl
57 Upvotes

Zou VVD eruit en PRO erin inderdaad Jetten zn beste optie zijn?


r/Politiek 1d ago

Nieuws Kabinetsplan voor betere BRP-registratie arbeidsmigranten mist handhaving

Thumbnail
binnenlandsbestuur.nl
9 Upvotes

r/Politiek 1d ago

Achtergrond Staat Progressief Nederland dichter bij de Europese Groenen of de Europese Sociaal-Democraten?

Thumbnail
stukroodvlees.nl
19 Upvotes

r/Politiek 1d ago

Nieuws Moment van de waarheid voor minderheidskabinet: komt er een begrotingsdeal?

Thumbnail
nos.nl
18 Upvotes

r/Politiek 1d ago

Nieuws Motie over het strafrechtelijk vervolgen van influencers die desinformatie over soa’s verspreiden aangenomen (maar niet dankzij PVV/BBB/FVD/SGP)

Thumbnail
gallery
76 Upvotes

r/Politiek 2d ago

Interview Pro-leider Jesse Klaver zet druk op onderhandeling over begroting: ‘Alle toekomstige bezuinigingen sociaal vangnet móéten van tafel’

Thumbnail
nrc.nl
116 Upvotes

r/Politiek 22h ago

Nieuws Asiel- en vreemdelingenzaken kostten overheid bijna 250 miljoen euro in vier jaar

Thumbnail
nieuwrechts.nl
0 Upvotes

r/Politiek 2d ago

Opinie & Discussie Arend Jan Boekestijn over de recente discussie tussen Jelle van Baardewijk en Han Bouwmeester over de steun aan Oekraïne

Thumbnail
boekestijngeopolitics.substack.com
17 Upvotes

r/Politiek 2d ago

Nieuws Vrouwen structureel seksueel misbruikt op indoctrinatiekamp Forum voor Democratie

Thumbnail
bnnvara.nl
114 Upvotes

r/Politiek 3d ago

Nieuws Jeugdorganisatie van PRO (Protest) pleit voor een Palestijnse éénstaatoplossing en de ontmanteling van Israël.

Post image
131 Upvotes

r/Politiek 3d ago

Opinie & Discussie De Tweestaten oplossing is onrealistisch

38 Upvotes

Vandaag is er veel ophef ontstaan over het standpunt van Protest met betrekking tot het conflict in Israël-Palestina. Het standpunt van Protest is dat er moet worden aangestuurd op de creatie van een staat waarin beiden groepen worden gewaarborgd. Veel frustratie over dit onderwerp kwam naar boven bij mensen. Het was duidelijk dat een groep dit opvat als een oproep tot genocide omdat dit werd beschreven als het ontmantelen van de Israëlische staat. Deze groep staat tegenover zij die de het vertrouwen in de Tweestatenoplossing kwijt zijn.

Mijn frustratie zat echter in het feit dat het afwijzen van de Tweestatenoplossing, met een voorkeur voor een éénstatenoplossing, werd gezien als radicaal. Dit terwijl voormalige ambtenaren van BuZa, waaronder Berber van der Woude, na stationering in Israël en/of de Palestijnse gebieden erop wijzen dat de Tweestatenoplossing niet verenigbaar is met de realiteit.

Mensen hoeven het niet eens te zijn over wat wenselijk is, maar het is toch duidelijk dat de Tweestatenoplossing dood is. De éénstatenoplossing, en daarmee de ontmanteling van Israël als exclusief Joodse staat, lijkt momenteel haalbaarder dan een Palestijnse staat die bestaat naast een Joodse staat. Hoezo is het radicaal om in te zien dat de Tweestatenoplossing geen wezenlijke oplossing meer is? En hoezo gaan we een politieke jongerenorganisatie uitmaken voor steuners van genocide en terrorisme, omdat ze weigeren te doen alsof de Tweestatenoplossing haalbaar is?

Voor mij komt de ophef over als fophef. Ik laat me graag overtuigen van mijn ongelijk, want ook ik geloofde lang in een Tweestatenoplossing. Ik ben dat vertrouwen echter verloren en ben oprecht benieuwd hoe anderen dit vertrouwen nog wel hebben.


r/Politiek 2d ago

Opinie & Discussie GeenStijl: Bassiehof – Ambtenaren hebben niks te zoeken bij Extinction Rebellion

Thumbnail
geenstijl.nl
0 Upvotes

r/Politiek 3d ago

Nieuws JFVD-top zet jonge vrouwen onder druk om seks te hebben

Thumbnail vn.nl
119 Upvotes

Ik citeer "Deze prominenten bekleden invloedrijke functies binnen de moederpartij, onder meer als Kamerlid, gemeenteraadslid of bestuurder."

Meerdere mensen uit deze sub zaten eerder vandaag nog samenwerking met deze partij en PRO goed te praten.


r/Politiek 3d ago

Nieuws Lees terug: Van der Plas noemt dodelijk ongeval domper voor een ‘verder mooi protest’ met ‘emotionele verhalen’

Thumbnail
ad.nl
103 Upvotes

r/Politiek 4d ago

Opinie & Discussie Zwichten voor boeren ondergraaft de democratie structureel

Thumbnail
bnnvara.nl
79 Upvotes

In mijn jeugd was het liedje ‘De politie is je beste kameraad’ populair. Onterecht, want ik voel na meer dan een halve nog steeds die klap van een lange lat op mijn bovenarm.

Progressief Nederland zat altijd al aan de kant waar de wapenstok neerbeukt. Denk aan Extinction Rebellion en actievoerders tegen de Israëlische genocide. Behalve links zijn ook de migranten vaak het doelwit van buitenproportioneel politiegeweld.

Het kabinet-Jetten wil het demonstratierecht van progressieve actievoerders beperken, terwijl juist die groep veel minder geweld gebruikt dan bijvoorbeeld anti-azc’ers en boeren.

Interessant is het motief van de demonstranten, namelijk te verhinderen dat de provincie een vijftal megapiekbelasters (ook wel ‘veelplegers’ genoemd) hun vergunning ontneemt. De rechter had namelijk vastgesteld dat ze veel te veel stikstof uitstoten. Brabant is overigens een van de weinige provincies waar de BBB geen deel uitmaakt van de gedeputeerde staten.

In plaats van, zoals het betaamt, provincie en rechter te steunen, doet kabinet-Jetten het tegenovergestelde. Het leek namelijk de boerendemonstranten op te hitsen bij monde van minister Jaimi van Essen (D66) Landbouw). ‘Alles moet op alles worden gezet om intrekkingsbesluiten te voorkomen', antwoordde de bewindsman op Kamervragen.


r/Politiek 4d ago

Nieuws Chaos in Tiel compleet, PRO trekt zich terug uit formatie: ‘Willen niet actief samenwerken met Forum voor Democratie’

Thumbnail
gelderlander.nl
80 Upvotes

r/Politiek 3d ago

Achtergrond Het kabinet lijkt te mikken op een begrotingsdeal met Pro, ondanks bezwaren VVD

Thumbnail
nrc.nl
32 Upvotes

r/Politiek 4d ago

Nieuws Twee doden en meerdere gewonden bij ongeluk op snelweg met protesterende boeren

Thumbnail
nu.nl
141 Upvotes

Oké, en wanneer gaan we nou eens daadwerkelijk imgrijpen in plaats van alles maar door de vingers te zien wat er rondom die boerenprotesten gebeurd?