GOOGLE
เผยแพร่:
•
ผู้เขียน: Tora Technical Editorial
ตรวจสอบข้อเท็จจริงแล้ว
Google Gemini 2.5 Flash: ยกระดับความเร็วและประสิทธิภาพสำหรับ Real-time Agentic Workflows
สรุปสาระสำคัญ (TL;DR):
การปรับปรุงสถาปัตยกรรมครั้งสำคัญของ Gemini 2.5 Flash: ความสามารถด้าน Multimodal Streaming, Sub-second TTFT และ Function Calling ความแม่นยำสูง
สรุปภาพรวม (Quick Take)
Google ได้เปิดตัวความก้าวหน้าล่าสุดในตระกูล Flash ด้วย **Gemini 2.5 Flash** โมเดลประมวลผลความเร็วสูงที่ถูกออกแบบมาเป็นพิเศษสำหรับงาน Real-time Conversational Agents, งานประมวลผลไฟล์เสียงและวิดีโอแบบสด (Live Streaming) และงาน Agentic Tool Use ที่ต้องการความเร็วระดับเสี้ยววินาที
สาระสำคัญทางเทคนิค (Technical Highlights)
- **Sub-second TTFT**: เวลาเริ่มปล่อยโทเค็นตัวแรกเฉลี่ยต่ำกว่า 250ms สำหรับคำขอระดับปานกลาง
- **Native Multimodal Audio/Video Ingestion**: สามารถรับสตรีมภาพและเสียงแบบดิบโดยไม่ต้องแปลงเป็นข้อความ (Transcription) ก่อน ช่วยลดขั้นตอนและเวลาในไปป์ไลน์
- **Structured Function Calling**: อัตราความผิดพลาดในการเรียกใช้ Tool ลดลงอย่างเห็นได้ชัด รองรับ Parallel Tool Calls ในข้อความเดียว
ตัวอย่างการส่งข้อความพร้อม Function Calling
import OpenAI from "openai";
const tora = new OpenAI({
baseURL: "https://www.toraapi.com/v1",
apiKey: process.env.TORA_API_KEY
});
const completion = await tora.chat.completions.create({
model: "gemini-2.5-flash",
messages: [{ role: "user", content: "ตรวจสอบเที่ยวบินจากกรุงเทพฯ ไปเชียงใหม่พรุ่งนี้เช้า" }],
tools: [
{
type: "function",
function: {
name: "searchFlights",
parameters: {
type: "object",
properties: {
origin: { type: "string" },
destination: { type: "string" },
date: { type: "string" }
},
required: ["origin", "destination", "date"]
}
}
}
]
});
console.log(completion.choices[0].message.tool_calls);
แหล่งข้อมูลอ้างอิงต้นฉบับ (Verified Sources)
- **บล็อกทางการ**: [Google AI Blog - Gemini Flash Technical Report](https://blog.google/technology/ai/)
ความโปร่งใสและแหล่งข้อมูลอ้างอิง
บทความนี้ได้รับการสังเคราะห์และตรวจสอบข้อเท็จจริงตามหลัก Tora Editorial Standards โดยอ้างอิงจากเอกสารทางการของผู้พัฒนา
เริ่มใช้งานโมเดล AI ผ่าน Tora API Gateway
รองรับมาตรฐาน OpenAI Compatible พร้อมระบบ Route Engine สลับ upstream อัตโนมัติเมื่อเกิด Rate Limit