lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

StepAudio 3 เปิดตัว: ครองอันดับหนึ่งทั้งด้านการอนุมานเสียงและการสนทนาแบบเรียลไทม์

动察 Beating ข่าวด่วน AI,阶跃星辰 เปิดตัว StepAudio 3 เปิดตัวพร้อมกันถึงห้าโมเดลเสียง ได้แก่ Realtime, ASR, TTS, Gen และ Music


ในการประเมินเสียงสองรายการของ Artificial Analysis,StepAudio 3 Realtime ครองอันดับหนึ่งทั้งสองรายการ โดย Conversational Dynamics ได้คะแนน 98.9% สูงกว่า Qwen Audio 3.0 Realtime Plus ที่ 98.4% และ GPT-Realtime-2 High ที่ 95.3% ส่วน Speech Reasoning ได้คะแนน 99.7% อยู่ในอันดับหนึ่งเช่นกัน การประเมินแรกทดสอบว่าโมเดลสามารถจัดการกับการหยุดชั่วคราว การผลัดกันพูด การขัดจังหวะของผู้ใช้ และคำตอบรับอย่าง "อืม" "ใช่" ได้หรือไม่ ส่วนการประเมินหลังทดสอบว่าโมเดลสามารถฟังเสียงและทำการ推理ได้โดยตรงหรือไม่


ASR ยังทำได้ 1.7% WER (อัตราคำผิดพลาด) ในอันดับการรู้จำเสียงแบบไม่สตรีมมิ่งของ Artificial Analysis ครองอันดับหนึ่งร่วมกับ Fun-Realtime-ASR-preview นอกจากนี้ StepAudio 3 Gen สามารถสร้างเสียงร้อง เอฟเฟกต์เสียง เสียงสภาพแวดล้อม และดนตรีได้ในครั้งเดียว และจัดเรียงตามฉากได้อย่างเป็นระบบ


ปัจจุบันโมเดลทั้งห้าได้เข้าสู่สายผลิตภัณฑ์เสียงของ阶跃แล้ว

แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น