Mistral stellt bahnbrechendes Open-Source-Audio-KI-Modell Voxtral vor
Während KI-Systeme immer ausgefeilter werden, entwickelt sich die Sprache immer mehr zu der wichtigsten Art und Weise, wie wir mit Maschinen interagieren. Das französische KI-Startup Mistral ist mit seinem ersten offenen Modell in die Audio-Arena eingestiegen und fordert die Dominanz geschlossener Unternehmenssysteme heraus, indem es Alternativen mit offenem Gewicht anbietet.
Am Dienstag stellte Mistral Voxtral vor, seine erste Familie von Audiomodellen für den Unternehmenseinsatz.
Das Unternehmen positioniert Voxtral als das erste offene Modell, das in der Lage ist, "wirklich nutzbare Sprachintelligenz in der Produktion" zu liefern.
Das bedeutet, dass Entwickler nicht mehr vor der Wahl stehen zwischen einem erschwinglichen, aber ungenauen offenen System, das mit Transkriptionen kämpft und kein wirkliches Verständnis bietet, und einem funktionalen, aber geschlossenen System, das mit höheren Kosten und eingeschränkter Einsatzkontrolle verbunden ist.
Für Unternehmen stellt Voxtral eine kostengünstige Alternative dar, die laut Mistral "weniger als die Hälfte des Preises" vergleichbarer Lösungen beträgt.

Bildnachweis: Mistral Mistral gibt an, dass Voxtral bis zu 30 Minuten Audio transkribieren kann. Dank seines LLM-Backbones, Mistral Small 3.1, versteht es bis zu 40 Minuten und ermöglicht es den Nutzern, Fragen zu den Audiodaten zu stellen, Zusammenfassungen zu erstellen oder Sprachbefehle in Echtzeit-Aktionen wie API-Aufrufe oder Funktionsausführung umzuwandeln. Voxtral ist mehrsprachig und kann Sprachen wie Englisch, Spanisch, Französisch, Portugiesisch, Hindi, Deutsch, Niederländisch und Italienisch transkribieren und verstehen.
Das Unternehmen bringt zwei Varianten seiner "Sprachverstehensmodelle" auf den Markt. Die erste, Voxtral Small, verfügt über 24B Parameter für den Einsatz im Produktionsmaßstab und konkurriert mit ElevenLabs Scribe, GPT-4o-mini und Gemini 2.5 Flash.
Techcrunch-Veranstaltung JETZT LIVE! TechCrunch Alle Bühne
Intelligenter bauen. Schneller skalieren. Tiefer verbinden. Nehmen Sie an einem Tag voller Strategien, Workshops und wertvollem Networking mit Führungskräften von Precursor Ventures, NEA, Index Ventures, Underscore VC und anderen teil.
Sparen Sie $450 bei Ihrem TechCrunch All Stage Pass
Intelligenter bauen. Schneller skalieren. Tiefer verbinden. Nehmen Sie an einem Tag voller Strategien, Workshops und wertvollem Networking mit Führungskräften von Precursor Ventures, NEA, Index Ventures, Underscore VC und anderen teil.
Boston, MA | 15. Juli JETZT ANMELDEN Das zweite Gerät, Voxtral Mini, verfügt über 3 Milliarden Parameter für lokale und Edge-Einsätze. Es gibt auch eine extrem erschwingliche, schlanke, schnelle API-Version des 3B-Modells namens Voxtral Mini Transcribe, die ausschließlich für Transkriptionsaufgaben optimiert ist und OpenAI Whisper bei weniger als der Hälfte der Kosten übertreffen soll.
Nutzer können Voxtral kostenlos testen, indem sie die API von Hugging Face herunterladen oder die Modelle im Chatbot Le Chat von Mistral ausprobieren. Die API-Integration für Anwendungen beginnt nach Angaben des Unternehmens bei 0,001 Dollar pro Minute.
Diese Veröffentlichung folgt auf Mistrals Ankündigung von Magistral im letzten Monat, seiner ersten Familie von Argumentationsmodellen, die Probleme schrittweise lösen, um die Zuverlässigkeit zu erhöhen.
Mistral, ein führendes KI-Unternehmen in Europa, ist bekannt für sein Eintreten für Open-Source-KI-Modelle. Anfang dieses Monats berichtete TechCrunch, dass das Unternehmen mit Investoren wie dem MGX-Fonds aus Abu Dhabi über die Beschaffung von bis zu 1 Milliarde US-Dollar an Eigenkapital verhandelt.
Verwandter Artikel
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund
Amazon hat Alexa for Shopping eingeführt, indem es den Rufus-Shopping-Chatbot mit Alexa+ in der App, auf der Website und auf Echo Show-Geräten zusammenführt.Der Assistent beantwortet Produktanfragen, vergleicht Artikel, verfolgt Preise und unterstüt
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
Empfehlungen zu verwandten Spezialthemen
Kommentare (1)
Während KI-Systeme immer ausgefeilter werden, entwickelt sich die Sprache immer mehr zu der wichtigsten Art und Weise, wie wir mit Maschinen interagieren. Das französische KI-Startup Mistral ist mit seinem ersten offenen Modell in die Audio-Arena eingestiegen und fordert die Dominanz geschlossener Unternehmenssysteme heraus, indem es Alternativen mit offenem Gewicht anbietet.
Am Dienstag stellte Mistral Voxtral vor, seine erste Familie von Audiomodellen für den Unternehmenseinsatz.
Das Unternehmen positioniert Voxtral als das erste offene Modell, das in der Lage ist, "wirklich nutzbare Sprachintelligenz in der Produktion" zu liefern.
Das bedeutet, dass Entwickler nicht mehr vor der Wahl stehen zwischen einem erschwinglichen, aber ungenauen offenen System, das mit Transkriptionen kämpft und kein wirkliches Verständnis bietet, und einem funktionalen, aber geschlossenen System, das mit höheren Kosten und eingeschränkter Einsatzkontrolle verbunden ist.
Für Unternehmen stellt Voxtral eine kostengünstige Alternative dar, die laut Mistral "weniger als die Hälfte des Preises" vergleichbarer Lösungen beträgt.

Mistral gibt an, dass Voxtral bis zu 30 Minuten Audio transkribieren kann. Dank seines LLM-Backbones, Mistral Small 3.1, versteht es bis zu 40 Minuten und ermöglicht es den Nutzern, Fragen zu den Audiodaten zu stellen, Zusammenfassungen zu erstellen oder Sprachbefehle in Echtzeit-Aktionen wie API-Aufrufe oder Funktionsausführung umzuwandeln. Voxtral ist mehrsprachig und kann Sprachen wie Englisch, Spanisch, Französisch, Portugiesisch, Hindi, Deutsch, Niederländisch und Italienisch transkribieren und verstehen.
Das Unternehmen bringt zwei Varianten seiner "Sprachverstehensmodelle" auf den Markt. Die erste, Voxtral Small, verfügt über 24B Parameter für den Einsatz im Produktionsmaßstab und konkurriert mit ElevenLabs Scribe, GPT-4o-mini und Gemini 2.5 Flash.
Techcrunch-VeranstaltungJETZT LIVE! TechCrunch Alle Bühne
Intelligenter bauen. Schneller skalieren. Tiefer verbinden. Nehmen Sie an einem Tag voller Strategien, Workshops und wertvollem Networking mit Führungskräften von Precursor Ventures, NEA, Index Ventures, Underscore VC und anderen teil.
Sparen Sie $450 bei Ihrem TechCrunch All Stage Pass
Intelligenter bauen. Schneller skalieren. Tiefer verbinden. Nehmen Sie an einem Tag voller Strategien, Workshops und wertvollem Networking mit Führungskräften von Precursor Ventures, NEA, Index Ventures, Underscore VC und anderen teil.
Boston, MA | 15. Juli JETZT ANMELDENDas zweite Gerät, Voxtral Mini, verfügt über 3 Milliarden Parameter für lokale und Edge-Einsätze. Es gibt auch eine extrem erschwingliche, schlanke, schnelle API-Version des 3B-Modells namens Voxtral Mini Transcribe, die ausschließlich für Transkriptionsaufgaben optimiert ist und OpenAI Whisper bei weniger als der Hälfte der Kosten übertreffen soll.
Nutzer können Voxtral kostenlos testen, indem sie die API von Hugging Face herunterladen oder die Modelle im Chatbot Le Chat von Mistral ausprobieren. Die API-Integration für Anwendungen beginnt nach Angaben des Unternehmens bei 0,001 Dollar pro Minute.
Diese Veröffentlichung folgt auf Mistrals Ankündigung von Magistral im letzten Monat, seiner ersten Familie von Argumentationsmodellen, die Probleme schrittweise lösen, um die Zuverlässigkeit zu erhöhen.
Mistral, ein führendes KI-Unternehmen in Europa, ist bekannt für sein Eintreten für Open-Source-KI-Modelle. Anfang dieses Monats berichtete TechCrunch, dass das Unternehmen mit Investoren wie dem MGX-Fonds aus Abu Dhabi über die Beschaffung von bis zu 1 Milliarde US-Dollar an Eigenkapital verhandelt.
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K





Heim






