การ์ดพาดหัวหลักสำหรับ 'Ling 3.0 Tiny vs Gemini 3.5 Flash-Lite' พร้อมคำโปรย 'ฟรีไม่ได้แปลว่าคุ้มค่า — เจ้าตลาดเดิมยังเป็นทางเลือกที่ปลอดภัย' และบัตรสถิติสองใบ: Ling 3.0 Tiny (AA Index 23, ให้คำตอบยาวมาก, ฟรีจนถึง 14 ส.ค.) และ Gemini 3.5 Flash-Lite (AA Index 36, ~490 tok/s, $0.30 / $2.50) วางโลโก้ OrcaRouter ไว้ที่มุมล่างขวา
Guides & Insights

Ling 3.0 Tiny vs Gemini 3.5 Flash-Lite: ฟรีไม่ได้แปลว่าถูก และเจ้าเดิมยังคงเป็นตัวเลือกที่ปลอดภัย

ผู้เขียน

Jim Song

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

“ฟรี” คือคำที่แพงที่สุดในศัพท์ของตลาดโมเดล เพราะโดยปกติแล้วมันหมายความว่ามีคนกำลังจะเรียกเก็บเงินจากคุณสำหรับสิ่งอื่นที่ไม่ใช่ราคาที่ติดป้าย นั่นคือกับดักที่ซ่อนอยู่ในการแข่งขันระหว่าง Ling 3.0 Tiny โมเดลให้เหตุผลแบบ MoE ขนาด 7.9 พันล้านพารามิเตอร์ใหม่ของ Ant Group InclusionAI และ Gemini 3.5 Flash-Lite ระดับ Ge​mini ที่ถูกที่สุดและเร็วที่สุดของ Go​ogle ในปัจจุบัน Ling 3.0 Tiny ตอนนี้เรียกใช้ฟรี และมีค่าใช้จ่าย $0.06 / $0.18 ต่อล้านโทเคนหลังโปรโมชันวันที่ 14 สิงหาคม — แต่ Artificial Analysis วัดได้ว่ามันใช้เอาต์พุตโทเคนถึง 210M เพียงเพื่อให้ได้คะแนนในกลุ่มที่มี 56 โมเดล เทียบกับค่ามัธยฐานที่ 63M และระบุว่ามัน “verbose มาก” Gemini 3.5 Flash-Lite มีค่าใช้จ่ายต่อโทเคนสูงกว่า 5 เท่า อยู่ที่ $0.30 / $2.50 แต่กลับมีดัชนีสติปัญญาอิสระ (Intelligence Index) อยู่ที่ 36 — สูงกว่า Ling 3.0 Tiny ถึง 13 จุด — และความเร็วเอาต์พุตประมาณ 490 โทเคนต่อวินาที ป้ายราคาที่ถูกกว่า ผู้พูดที่เร็วกว่า และคะแนนที่ต่ำกว่า ล้วนเป็นโมเดลเดียวกัน นั่นคือเรื่องราวทั้งหมดของการเปรียบเทียบนี้ และเป็นเหตุผลทั้งหมดที่ทำให้คุณต้องคิดให้รอบคอบก่อนจะเลือกใช้โมเดลใหม่เพียงเพราะราคาอย่างเดียว

โมเดลทั้งสองอยู่ในกลุ่มราคาประหยัด แต่กำลังอยู่คนละจุดในวงจรชีวิตของกลุ่มนี้ Gemini 3.5 Flash-Lite คือผู้เล่นรายเดิมที่เติบโตเต็มที่แล้ว: เปิดตัวเมื่อวันที่ 21 กรกฎาคม 2026 ถูกวัดผลซ้ำอย่างต่อเนื่องโดยบุคคลที่สาม และถูกนำไปใช้อย่างแพร่หลายในฐานะตัวเลือกระดับค่าเริ่มต้นสำหรับงานแบบ agentic ที่มีปริมาณสูงและอ่อนไหวต่อความหน่วง ส่วน Ling 3.0 Tiny เพิ่งเปิดตัวได้หนึ่งสัปดาห์ ตั้งราคามาเพื่อดึงดูดผู้ใช้ และถูกวัดผลเพียงครั้งเดียว บทความนี้แยกให้เห็นว่าแต่ละโมเดลแท้จริงคืออะไร ตัวเลขจากแหล่งอิสระบอกอะไรบ้าง และเหตุใดราคา "ฟรี" จึงเป็นตัวเลขที่มีประโยชน์น้อยที่สุดในการเปรียบเทียบครั้งนี้

Ling 3.0 Tiny ผู้มาใหม่ที่มาพร้อมมิเตอร์

Ling 3.0 Tiny launched on August 6, 2026 on commercial APIs with a quiet-listing pattern rather than a launch event. It is a mixture-of-experts model with 7.9B total parameters and roughly 1.3B active per token, a 256K-token context window (listed as 262K on the commercial listings and Artificial Analysis), up to 32K output tokens, native function calling, and prompt caching. Two modes switch per request: "Thinking," on by default, which spends output tokens on extended reasoning, and "Instant," which answers directly. It is text-in, text-out — no image, audio, or video input.

The pricing structure deserves precision, because "free" is doing a lot of work. It is listed as inclusionai/ling-3.0-tiny:free at $0 per million tokens on both sides; a second gateway runs it free until 8:00am PT on August 14, 2026, then applies its listed rate of $0.06 per million input and $0.18 per million output tokens, with cached input at $0.01. Artificial Analysis, which sampled the free tier, shows the $0.00 / $0.00 price on its live page. So the model is genuinely free right now, and genuinely metered a week from now.

Screenshot of the Artificial Analysis page for Ling 3.0 Tiny, showing an Intelligence Index of 23, price $0.00 / $0.00 on the free tier, a 210M-token verbosity read versus a 63M median, and output speed listed as N/A. REUSED from the what-is-ling-3-0-tiny explainer (audited).

Gemini 3.5 Flash-Lite ผู้ครองตำแหน่งปัจจุบัน

Gemini 3.5 Flash-Lite คือคำตอบของ Go​ogle สำหรับคำถามเดียวกัน โดยจัดอยู่ในระดับที่ต่ำกว่าหนึ่งขั้นในไลน์ Gemini 3.5 โดยรองรับมัลติโมดัลโดยธรรมชาติในอินพุต — ข้อความ รูปภาพ วิดีโอ เสียง และไฟล์ — โดยมีเอาต์พุตเป็นข้อความ หน้าต่างบริบท 1M โทเคน สูงสุด 64K โทเคนเอาต์พุต และระดับการใช้เหตุผลที่ปรับแต่งได้ (ต่ำสุด ต่ำ สูง) เพื่อให้ไปป์ไลน์สามารถปรับความลึกและค่าใช้จ่ายต่อคำขอได้ คะแนนอิสระของมันคือการก้าวกระโดดเชิงรุ่นอย่างแท้จริง: Artificial Analysis Intelligence Index 36 อยู่ในอันดับ #12 จากโมเดลที่ติดตาม 151 ตัว เพิ่มขึ้นจาก 25 ของ Gemini 3.1 Flash-Lite ในด้านความเร็ว มันเป็นโมเดลที่เร็วที่สุดในซีรีส์ 3.5 — Go​ogle ระบุ 350 โทเคนเอาต์พุต/วินาทีตอนเปิดตัว และหน้าสดของ AA วัดได้ประมาณ 490 โทเคน/วินาที อยู่ในอันดับ #2 ในบรรดาโมเดลที่ติดตาม ตัวเลขเชิงเอเจนต์ที่ผู้ให้บริการรายงาน — 74.0% บน OSWorld-Verified, 54% บน Terminal-Bench 2.1, 72.2% บนการทดสอบการค้นคืนแบบหลายเข็มขนาด 128K — เป็นตัวเลขของ Go​ogle เองและเป็นแนวทางชี้ทิศทางมากกว่าความจริงที่ต้องเชื่อถือ และมีประเด็นที่ยังไม่ชัดเจนหนึ่งประเด็น (computer-use ถูกระบุว่าเป็นความสามารถในตัวในบล็อกของ Go​ogle แต่ไม่รองรับในเอกสาร API) ที่ควรตรวจสอบก่อนที่คุณจะพึ่งพามัน

นอกจากนี้ เมื่อคิดต่อโทเคนแล้ว มันก็ไม่ถูกสำหรับระดับของมัน ชื่อ "Lite" บรรยายถึงตำแหน่งของโมเดลในกลุ่มผลิตภัณฑ์ ไม่ใช่ราคาป้ายที่ลดลง: Gemini 2.5 Flash-Lite อยู่ที่ $0.10 / $0.40, 3.1 Flash-Lite อยู่ที่ $0.25 / $1.50 และ 3.5 Flash-Lite อยู่ที่ $0.30 / $2.50 ต่อล้านโทเคน โดย cached input อยู่ที่ $0.03 ความได้เปรียบด้านประสิทธิภาพมาจากความเร็วและความประหยัดโทเคน และการวัดของ Artificial Analysis เองแสดงให้เห็นว่าต้นทุนจริงต่องานเพิ่มขึ้นราวเท่าตัวในแต่ละรุ่น ขณะที่เวลาต่องานลดลงครึ่งหนึ่ง

กระดานคะแนนอิสระ อ่านในบริบท

เมื่อนำทั้งสองโมเดลมาเทียบกันบนดัชนีเดียวกัน ช่องว่างก็ชัดเจนมาก: Gemini 3.5 Flash-Lite ได้ 36 คะแนน ส่วน Ling 3.0 Tiny ได้ 23 คะแนน แต่การเปรียบเทียบที่ดูเป็นหัวข้อข่าวนั้นเป็นเพียงครึ่งหนึ่งของภาพรวม เพราะโมเดลทั้งสองไม่ได้ถูกวัดผลเทียบกับกลุ่มเดียวกัน AA จัดอันดับ Ling 3.0 Tiny อยู่ที่ #6 จาก 56 ในคลาสโมเดลขนาดเล็ก โดยมีค่ามัธยฐานของคลาสอยู่ที่ 8 — ซึ่งสูงกว่าเกณฑ์เฉลี่ยสำหรับโมเดลขนาดนี้มาก ส่วน Gemini 3.5 Flash-Lite อยู่อันดับที่ #12 จาก 151 ในกลุ่มที่ติดตามทั้งหมดในวงกว้าง หนึ่งคือโมเดลขนาดเล็กที่โดดเด่น ส่วนอีกหนึ่งคือโมเดลราคาประหยัดที่แข็งแกร่งในกลุ่มเปิด ข้อความทั้งสองเป็นจริง และมีความหมายที่แตกต่างกัน Ling 3.0 Tiny ให้ความคุ้มค่ากว่าเมื่อเทียบกับขนาดคลาสของมัน ในขณะที่ Gemini 3.5 Flash-Lite ก็ให้ความคุ้มค่าเมื่อเทียบกับระดับของมัน — แต่ Gemini 3.5 Flash-Lite ยังคงเป็นโมเดลที่มีความสามารถมากกว่าอย่างเห็นได้ชัดบนมาตราส่วนอิสระเดียวกัน

Comparison scoreboard for Ling 3.0 Tiny vs Gemini 3.5 Flash-Lite. Left column Ling 3.0 Tiny: AA 23, $0.06 / $0.18 after promo, 210M output tokens, text-only, 256K context, speed N/A (Vercel 264 tok/s). Right column Gemini 3.5 Flash-Lite: AA 36, $0.30 / $2.50, 43M output tokens, text + image + video + audio, 1M context, ~490 tok/s (AA). Footer: 'Both models per Artificial Analysis.' OrcaRouter logo composited bottom-right.

ขนาด บรรทัดละหนึ่ง:

• คะแนนอิสระ — Ling 3.0 Tiny AA Index 23 (#6/56, ค่ามัธยฐานคลาส 8) เทียบกับ Gemini 3.5 Flash-Lite AA Index 36 (#12/151).

ราคา — Ling 3.0 Tiny $0.06 / $0.18 ต่อ 1M หลังจากโปรโมชันฟรี เทียบกับ Gemini 3.5 Flash-Lite $0.30 / $2.50 ต่อ 1M (อินพุตแคช $0.03)

• ความฟุ่มเฟือย — Ling 3.0 Tiny สร้างโทเคนเอาต์พุต 210M ตลอดการรันดัชนี เทียบกับ Gemini 3.5 Flash-Lite ที่วัดได้แต่ไม่ถูกจัดว่าฟุ่มเฟือยตามแฟล็กนั้น

• รูปแบบข้อมูล — Ling 3.0 Tiny รองรับเฉพาะข้อความ เทียบกับ Gemini 3.5 Flash-Lite ที่รองรับข้อความ รูปภาพ วิดีโอ เสียง และไฟล์นำเข้า

• บริบท — 256K บน Ling 3.0 Tiny เทียบกับ 1M บน Gemini 3.5 Flash-Lite โดยทั้งคู่มีเอาต์พุตสูงสุด 64K

• ความเร็ว — Ling 3.0 Tiny ~90–264 tokens/s ในกลุ่มเอนด์พอยต์ที่เผยแพร่ตัวเลข เทียบกับ Gemini 3.5 Flash-Lite ~490 tokens/s จากการวัดสดของ AA

แถวความเร็วคือสิ่งที่อาจมีการเปลี่ยนแปลงมากที่สุด ความเร็วเอาต์พุตของ Ling 3.0 Tiny ยังไม่ได้รับการยืนยันอย่างแท้จริง: Artificial Analysis ระบุว่าเป็น N/A ในขณะที่ Vercel โฆษณาไว้ที่ 264 โทเคนต่อวินาที ค่า ~490 โทเคนต่อวินาทีของ Gemini 3.5 Flash-Lite เป็นการวัดแบบสดจาก Artificial Analysis (AA) ซึ่งดำเนินการหลังจากความผันผวนในช่วงเปิดตัวของมันสงบลงแล้ว สำหรับกลุ่มที่อ่อนไหวต่อความหน่วง นั่นคือความแตกต่างระหว่างค่าที่ทราบแน่นอนกับคำถามที่ยังไม่มีคำตอบ

เศรษฐศาสตร์แห่งความเยิ่นเย้อ: เหตุใดของฟรีจึงไม่ใช่ของถูก

นี่คือการคำนวณที่มักใช้ตัดสินการเปรียบเทียบนี้ ลองรันงานที่ต้องใช้การให้เหตุผลหนักๆ แบบเดียวกัน เช่น 4,000 โทเคนนำเข้า 2,000 โทเคนส่งออก ผ่านทั้งสองโมเดลหลังจากโปรโมชันของ Ling 3.0 Tiny สิ้นสุดลง Ling 3.0 Tiny คิดเงิน (4,000 × $0.06 + 2,000 × $0.18) / 1,000,000 หรือประมาณ $0.0006 Gemini 3.5 Flash-Lite คิดเงิน (4,000 × $0.30 + 2,000 × $2.50) / 1,000,000 หรือประมาณ $0.0062 ด้วยจำนวนโทเคนที่เท่ากัน Ling 3.0 Tiny ถูกกว่า 10 เท่า จากนั้นเพิ่มเรื่องความเยิ่นเย้อของเอาต์พุต: โมเดลที่ใช้การให้เหตุผลซึ่งปล่อยโทเคนความคิดเป็นเอาต์พุตจะไม่ได้สร้างจำนวนโทเคนที่เท่ากัน หากอัตราส่วนความเยิ่นเย้อระหว่าง 210M กับ 63M ของ Ling 3.0 Tiny ยังคงเป็นจริงกับเวิร์กโหลดของคุณ ต้นทุนต่องานจริงจะเพิ่มขึ้นประมาณสามเท่าทางฝั่งเอาต์พุต และความได้เปรียบ 10 เท่าก็หดเหลือประมาณ 3–4 เท่า ยังถูกกว่า — แต่ไม่ฟรีอีกต่อไป และไม่ได้อยู่ในระดับที่ตัวเลข 210M ทำให้ดูเหมือน

การมองอย่างตรงไปตรงมาคือ โมเดลทั้งสองไม่ได้ใช้แทนกันได้ในคุณภาพระดับเดียวกัน คะแนน 23 ของ Ling 3.0 Tiny ถือว่ายอดเยี่ยมสำหรับโมเดลที่ใช้พารามิเตอร์ 1.3B; ส่วนคะแนน 36 ของ Gemini 3.5 Flash-Lite อยู่คนละลีกของความสามารถ พร้อมทั้งระบบวิทัศน์ บริบท 1M และความเร็วที่ได้รับการพิสูจน์แล้ว คุณต้องจ่ายเพิ่มสำหรับช่องว่างนั้น — ราคาต่อโทเคนเป็นห้าเท่า และสูงขึ้นต่องานเมื่อคิดรวมความแตกต่างด้านความเร็ว — แต่มันคือช่องว่างด้านความสามารถจริง ไม่ใช่ช่องว่างทางการตลาด หากปริมาณงานของคุณรับได้กับคุณภาพของโมเดลที่ถูกกว่า Ling 3.0 Tiny คือความคุ้มค่าที่เหนือกว่า หากปริมาณงานของคุณต้องการความสามารถนั้น ไม่มีข้อได้เปรียบด้านราคาใดที่จะปิดช่องว่างนี้ได้

จุดที่เราเตอร์คุ้มค่า

นี่คือรูปแบบของเวิร์กโหลดที่ routing tier เอาชนะการผูกมัดกับโมเดลเดียว และข้อเท็จจริงด้านโฮสติ้งมีความสำคัญต่อวิธีที่คุณสร้างมัน Gemini 3.5 Flash-Lite เปิดใช้งานบน OrcaRouter แล้วในราคารายการของผู้ให้บริการ — $0.30 ขาเข้า / $2.50 ขาออกต่อ 1M ส่งผ่านด้วยมาร์กอัป 0% ดังนั้นตัวเลขบนเรตการ์ดของ Go​ogle คือตัวเลขฝั่งเรา และการลดราคาในอนาคตจะมีผลในวันเดียวกัน มันให้บริการผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เดียวกันกับโมเดลอื่น ๆ อีก 200+ รุ่น พร้อมการเฟลโอเวอร์อัตโนมัติข้ามผู้ให้บริการ สำหรับกรณีที่ผู้ให้บริการพื้นฐานมีประสิทธิภาพลดลงกลางรัน และ routing DSL สามารถส่งพรอมป์ไปยังหลายโมเดลและเก็บคำตอบที่ดีที่สุดไว้

Ling 3.0 Tiny ไม่ได้อยู่บน OrcaRouter; มันให้บริการผ่านเอนด์พอยต์ของตัวเอง ซึ่งตอนนี้ยังฟรีอยู่ การรวมกันเช่นนี้ทำให้เหตุผลในการใช้ตัวจัดเส้นทางแข็งแกร่งขึ้น ไม่ใช่อ่อนลง ใช้ช่วงฟรีในการทดสอบวัดประสิทธิภาพของ Ling 3.0 Tiny กับทราฟฟิกของคุณเองก่อนที่จะเสียเงิน จากนั้นสร้างเส้นทางสำหรับการใช้งานจริงบนระดับโฮสต์ — Gemini 3.5 Flash-Lite สำหรับการเรียกที่ต้องใช้วิทัศน์ บริบทระยะยาว หรือโปรไฟล์ความเร็วที่คงที่ โดยเลเยอร์การจัดเส้นทางสามารถยกระดับไปยังโมเดลที่แพงกว่าสำหรับกลุ่มน้อยที่ซับซ้อนได้อย่างอิสระ ระดับฟรีเป็นการทดลองที่ยอดเยี่ยมแต่เป็นความพึ่งพาที่เปราะบาง; ระดับโฮสต์คือสิ่งที่คุณสามารถสร้างผลิตภัณฑ์ได้ บน OrcaRouter คุณสามารถรันทั้งคู่ในกราฟเดียวกัน — Ling 3.0 Tiny ผ่านเอนด์พอยต์โดยตรง, Gemini 3.5 Flash-Lite ผ่านคีย์ — และให้ตัวจัดเส้นทางตัดสินใจต่อคำขอ

Screenshot of the OrcaRouter model page for Gemini 3.5 Flash-Lite (google/gemini-3.5-flash-lite) showing $0.30 input / $2.50 output per 1M tokens, a 1M-token context, up to 64K max output, multimodal text + image + video + file + audio input, and a p50 time-to-first-token of 819ms over the last 7 days. Fresh Edge-headless capture, audited.

คำตัดสิน

หากคุณกำลังเลือกระหว่างสองรุ่นนี้และไม่ได้ใช้งานร่วมกัน การตัดสินใจนั้นพูดง่ายแต่ยากจะทำใจยอมรับ Ling 3.0 Tiny เป็นข้อเสนอที่คุ้มกว่าแต่เป็นโมเดลที่อ่อนแอกว่า: เป็น reasoning tier สำหรับข้อความเท่านั้นที่เพิ่งเปิดตัวได้หนึ่งสัปดาห์ มีคะแนนยอดเยี่ยมเมื่อเทียบกับขนาด ราคาเชิงรุก และภาพรวมด้านความเร็วและความเยิ่นเย้อที่ยังไม่ชัดเจน คุ้มค่าที่จะทดลองใช้ฟรีทันที และควรรู้ว่าจะเริ่มคิดค่าบริการตามการใช้วันที่ 14 สิงหาคม Gemini 3.5 Flash-Lite เป็นค่าเริ่มต้นสำหรับงาน production ที่ปลอดภัยกว่า: ได้คะแนนสูงกว่า 13 แต้มจากการประเมินอิสระ รองรับมัลติโมดัล บริบท 1M เร็วกว่า 5 เท่าจากการวัดที่แน่ชัด และตั้งราคาไว้สอดคล้องกัน ฟรีไม่ได้แปลว่าถูกเมื่อโมเดลพูดมากกว่า 3 เท่าเพื่อคิดบนเพดานความสามารถที่ต่ำกว่า — และตัวเลือกเดิมคือตัวเลือกที่ปลอดภัยด้วยเหตุผล

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

ติดต่อเรา

เข้าร่วมคอมมูนิตี้ของเรา

DiscordEmailXGitHubYouTube