Ga naar hoofdinhoud

Spraakinvoer voor Deep Code: zeg wat je denkt. AI regelt de rest.

AI heeft ons aanzienlijk productiever gemaakt, maar typen blijft de bottleneck. Spraakdicteertools zoals Siri of Google-spraakinvoer werken prima voor het versturen van een sms-bericht, maar ze hebben een fundamentele blinde vlek: ze weten niets van je project. Ze transcriberen woorden -- ze begrijpen de bedoeling niet.

Je hebt niet nodig dat je computer transcribeert wat je hebt gezegd. Je hebt nodig dat je computer begrijpt wat je wilt doen.

Deep Code lost dit op door spraakinvoer direct in de interface te integreren, met volledige kennis van je projectcontext.

Waarom generieke spraakhulpmiddelen tekortschieten

Ze transcriberen. Ze begrijpen niet.

Consumentenspraakhulpmiddelen zijn gebouwd voor dagelijkse gesprekken -- sms'jes, korte notities, zoekopdrachten. Hun taak is letterlijke transcriptie, woord voor woord.

AI aansturen met je stem is een totaal ander probleem. Je dicteert geen bericht -- je geeft instructies. Het verschil is belangrijk:

  • Dicteren: "Herinner me eraan melk te kopen" -> getranscribeerd als "Herinner me eraan melk te kopen"
  • AI-aansturing: "Verander de poort in dat configuratiebestand dat ik gisteren heb bewerkt naar 8080" -> de AI moet weten welk configuratiebestand, welk veld en welke waarde -- en dat zit allemaal niet in de woorden alleen.

Een generiek gereedschap legt elk woord trouw vast. Het kan niet herleiden waar die woorden daadwerkelijk naar verwijzen.

Je hersenen werken niet lineair. Hun transcriptie wel.

Je denkt in uitstapjes. Je verandert van gedachte halverz in een zin. Je komt terug op eerdere ideeën. Dit is normaal.

Spraakdicteertools gebruiken streaming transcriptie -- tekst verschijnt terwijl je spreekt. Voor chatten is dat prima. Het geven van technische instructies levert echter problemen op:

  • Verander je halverwege van gedachte? Het eerste deel vervuilt de uiteindelijke prompt.
  • Associëer je vrij? De ideeën komen in chronologische volgorde, niet in logische volgorde.
  • Pauzeer je om na te denken? Het gereedschap weet het verschil niet tussen een pauze en een eindpunt.

Je geest werkt als een mindmap. Een lineaire transcriptie is een rechte lijn -- er gaat veel verloren onderweg.

Deep Code Spraakinvoer: gebouwd voor AI-aansturing

Spraak invoer die context begrijpt. Spreek natuurlijk in elke taal, meng termen vrijelijk -- alles wordt georganiseerd. Verkeerd gezegd? Geen probleem -- contextbewuste correctie handelt het automatisch af.

Contextbewuste transcriptie

Je spraak wordt getranscribeerd en vervolgens een tweede keer verfijnd door AI, met behulp van de huidige gesprekscontext en de bestandsstructuur van je project.

Wat dit in de praktijk betekent:

  • Bestandsnamen, mappaden en variabelenamen die je noemt, worden gekoppeld aan hun daadwerkelijke tegenhangers in je project.
  • Wat je zegt en direct daarna corrigeert, wordt eruit gefilterd -- niet getranscribeerd.
  • Verstrooide, niet-lineaire gedachten worden opnieuw geordend naar belang en logische volgorde.

Voorbeeld: je werkt met config/app.yaml en wilt de poort wijzigen naar 8080. Je zegt:

"Verander de poort in dat configuratiebestand -- het app-bestand, degene waar je eerder aan hebt gewerkt -- naar 8080. Volgens mij heb ik het al een keer veranderd maar het leek niet door te gaan..."

Een standaard dicteergereedschap transcribeert die rommel letterlijk. Deep Code geeft je:

"Verander het poortveld in config/app.yaml naar 8080."

Spreek vrij. Stotteren is geen probleem.

Dat is het hele punt.

Standaard dicteren bestraft slordige spraak -- elk woord wordt opgenomen, dus een fout betekent opnieuw beginnen. De spraakinvoermodule draait die aanname om. Spreek zoals je wilt. Het systeem maakt het opgeruimd.

Het verwerkt automatisch:

  • Correcties halverwege een zin: eerder tegengesproken inhoud wordt verwijderd.
  • Vage verwijzingen: "dat bestand", "degene van gisteren", "het ding waar we het net over hadden" -- opgelost aan de hand van de context.
  • Herhalingen: dubbele ideeën worden gededuplicheerd.
  • Vulwoorden: eh, uh, zeg maar, je weet wel -- eruit gefilterd.

Geef de kern door. Het systeem doet de rest.

Taalwisseling en gemengde termen

Ontwikkelaars mengen voortdurend technische termen in hun dagelijkse spraak -- bestandsnamen, functienamen, frameworknamen, CLI-opdrachten. Generieke spraakhulpmiddelen zijn berucht slecht in dit opzicht en maken useSnippets.ts vaak tot onzin of hakken npm install in willekeurige woorden.

De spraakinvoermodule is geoptimaliseerd voor programmeercontexten. Het raadpleegt de bestandsboom van je project om te weten wat een echte identifier is en wat ruis:

  • Bestandsnamen zoals useSnippets.ts en src/utils/index.ts worden intact bewaard.
  • Variabele- en functienamen worden correct herkend.
  • Framework- en gereedschapsnamen (Java, C++, npm, git) werken direct.

Geen haast -- neem tot 5 minuten de tijd

De meeste spraakberichtgereedschappen beperken je tot 60 seconden en starten een aftelling die alles gehaast doet aanvoelen.

Deep Code ondersteunt continue opname tot 5 minuten. Denk in je eigen tempo. Pauzeer wanneer je nodig hebt. Er tikt geen klok.

Hoe het te gebruiken

De spraakinvoermodule bevindt zich in de rechtsonderhoek van het Deep Code-venster. Geen menu's om te openen, geen panelen om in te schakelen -- het is er altijd.

Stap 1: Start de opname

Beweeg over de opnameknop in de rechtsonderhoek om de tooltip te zien. Klik om te starten.

Stap 2: Spreek

Tijdens de opname toont de knop een live golfvorm die je audioweergave weerspiegelt. Je wordt in realtime vastgelegd.

Tijdens de opname kun je:

  • Zeggen wat er in je opkomt, in willekeurige volgorde.
  • Zelfcorrigeren of fouten negeren -- het systeem handelt ze af.
  • Pauzeren om na te denken -- de opname loopt door. Pak de draad weer op wanneer je klaar bent.

Stap 3: Stop de opname

Klik op dezelfde knop om te stoppen. De audio wordt geüpload en de transcriptie begint.

Stap 4: Controleer en verstuur

Zodra de transcriptie is voltooid, zie je de verwerkte tekst ter controle. Vanuit hier kun je:

  • Controleren of de door AI verfijnde tekst je bedoeling weergeeft.
  • De tekst direct bewerken indien nodig.
  • Bestandsreferenties invoegen vanuit het Bestandsverkenner-paneel.
  • Promptsjablonen invoegen vanuit het Fragmentenpaneel.
  • Klik op versturen als het er goed uitziet.

Alles gebeurt in één venster -- geen contextwisseling.

Hoe het zich verhoudt

Generieke spraakhulpmiddelen (Siri, Google dicteren, etc.)Deep Code Spraakinvoer
DoelDagelijks chatten, notities, zoekenAI-aansturing -- begrijpt wat je wilt doen
TranscriptieStreaming, woord voor woord terwijl je spreektContextbewuste AI-verwerking, georganiseerd voor uitvoer
DenkstijlVereist lineaire, zorgvuldige spraakVrij, niet-lineair -- zeg wat er in je opkomt
Omgaan met foutenOpnieuw beginnenAutomatisch gefilterd en gecorrificeerd
Technische termenVervormt regelmatig code-identifiersHerkent projectbestanden, functienamen, CLI-opdrachten
TijdslimietDoorgaans ~60 secondenTot 5 minuten
ProjectbewustzijnGeenDiepe integratie met Bestandsverkenner- en Fragmentenpaneel

Samenvatting

De spraakinvoermodule is geen tekst-naar-spraakhulpmiddel -- het is een brug van gedachte naar instructie. Het neemt hoe je van nature denkt en praat en zet dat om in iets waar een AI mee aan de slag kan.

Eén ding om te onthouden:

Spreek vrij. Het systeem doet de rest.