Dataconomy NL
Subscribe
No Result
View All Result
Dataconomy NL
Subscribe
No Result
View All Result
Dataconomy NL
No Result
View All Result

Google Gemini transcribeert nu audiobestanden

byAytun Çelebi
11 september 2025
in Kunstmatige Intelligentie
Home Nieuws Kunstmatige Intelligentie
Share on FacebookShare on Twitter
Google Preferred Source

Met de Gemini AI -assistent van Google staat nu audiobestanden uploads toe, waardoor gebruikers belangrijke informatie kunnen transcriberen, samenvatten en extraheren uit opnames. Deze nieuwe functie converteert maximaal 10 minuten spraakmemo’s, vergaderingen, lezingen en interviews in doorzoekbare documenten direct binnen de AI -omgeving. Uploads van audiobestanden worden ondersteund op zowel internet- als mobiele applicaties. Gebruikers hebben toegang tot de functie via de standaard bestand-upload-interface. Dit verschilt van de realtime spraakopdrachtverwerking van Gemini Live, omdat de nieuwe functie vooraf opgenomen audio verwerkt voor gegevensextractie en -analyse. Josh Woodward, Google’s VP van Gemini, verklaarde dat het uploaden van audiobestanden de meest gevraagde functie was van Gemini -gebruikers. Deze vraag benadrukt een behoefte aan gestroomlijnde audioverwerking binnen de AI -assistent.

Transcriptienauwkeurigheid en functie -integratie

Tijdens het testen heeft Gemini verschillende audiotypes nauwkeurig getranscribeerd, waaronder comedy -albumschetsen en telefoongesprekken, met slechts kleine fouten in naamherkenning. Het systeem identificeerde ook effectief belangrijke elementen en genereerde takenlijsten uit de audio-inhoud. De toevoeging van audioverwerking komt overeen met recente Gemini-integraties, zoals implementaties in verschillende apps, het testen van een kaartgebaseerde visuele interface en uitgebreide personalisatie-opties. Deze updates verbeteren de functionaliteit en gebruikerservaring van Gemini gezamenlijk.

Vergelijking met andere AI -assistenten

Hoewel de audiomogelijkheden van Gemini niet uniek zijn, zijn ze vergelijkbaar met functies van concurrenten zoals Chatgpt, die zijn Whisper -transcriptiemodel gebruikt. De Claude van Anthropic ondersteunt ook audioverwerking in bepaalde ontwikkelaarstools, en perplexiteit kan gegevens uit YouTube -video’s extraheren. Gemini wil zich concentreren op dagelijkse use cases voor een breed gebruikersbestand.

Geavanceerde audiogegevensverwerking

Naast eenvoudige transcriptie stelt Gemini gebruikers in staat om taalvereenvoudiging aan te vragen, sprekerspecifieke opmerkingen te extraheren, vragen te genereren uit audio-inhoud of studiegidsen te maken uit opgenomen discussies. Deze opties bieden hulpmiddelen om audio -informatie efficiënt te manipuleren en opnieuw te gebruiken.

Beperkingen van de audiofunctie

De huidige limiet van 10 minuten voor uploads van het audiobestand beperkt de toepasbaarheid voor langere opnames. Vrije gebruikers worden ook geconfronteerd met dagelijkse gebruikslimieten voor audioverwerking. Deze beperkingen kunnen van invloed zijn op gebruikers met uitgebreide behoeften aan audioverwerking. Google heeft geen specifieke prijzen vrijgegeven voor hoog-volume audioverwerking. Audioverwerking is echter geïntegreerd in het reguliere Gemini -quotum. Dit suggereert dat gebruikers hun gebruik moeten beheren om te voorkomen dat de toegewezen bronnen worden toegewezen.


Uitgelichte afbeeldingskrediet

Tags: Google Gemini

Related Posts

Microsoft test de nieuwe pc-inzichtfunctie van Copilot in Windows 11

Microsoft test de nieuwe pc-inzichtfunctie van Copilot in Windows 11

14 juli 2026
OpenAI stopt met de Atlas-browser om zich te concentreren op de nieuwe ChatGPT-superapp

OpenAI stopt met de Atlas-browser om zich te concentreren op de nieuwe ChatGPT-superapp

14 juli 2026
Gratis toegang tot Claude Fable 5 verlengd tot 19 juli

Gratis toegang tot Claude Fable 5 verlengd tot 19 juli

13 juli 2026
OpenAI heft de GPT-5.6 Sol-gebruikslimieten tijdelijk op

OpenAI heft de GPT-5.6 Sol-gebruikslimieten tijdelijk op

13 juli 2026
Meta lanceert Muse Spark 1.1 voor agentische AI-codering

Meta lanceert Muse Spark 1.1 voor agentische AI-codering

10 juli 2026
SpaceXAI lanceert Grok 4.5 als nieuw vlaggenschip AI-model

SpaceXAI lanceert Grok 4.5 als nieuw vlaggenschip AI-model

10 juli 2026

Recent Posts

  • Digitale transformatie van inkoopprocessen: het bouwen van een bedrijfsinkoopsysteem gebaseerd op het voorbeeld van een internationaal industrieel holdingproject
  • Waarom de gefragmenteerde transportsystemen van Europa AI een voorsprong kunnen geven
  • IT-leiders geven prioriteit aan vertrouwen boven AI-functies, zegt NinjaOne
  • Cisco: AI zal het bedrijfsnetwerkverkeer in 2026 verdrievoudigen
  • 6G zorgt voor ultralage latentie voor verbonden voertuigen

Recent Comments

Geen reacties om weer te geven.
Dataconomy NL

COPYRIGHT © DATACONOMY MEDIA GMBH, ALL RIGHTS RESERVED.

  • Sample Page

Follow Us

  • Sample Page
No Result
View All Result
Subscribe

This website uses cookies to improve your experience. You can choose to accept or reject them. Visit our Privacy Policy.