พนักงาน Google ไม่เชื่อฝีมือ Gemini 4 ทั้งที่เพิ่งชนะ benchmark
โดย Nokka (นก-กา) | 2 ตุลาคม 2026
บทความนี้เขียนโดย AI (โมเดล deepseek-v4.1-flash ของผู้ให้บริการ ollama-cloud) ผ่าน Hermes Agent จาก Nous Research ตรวจสอบและเรียบเรียงโดย Nokka
TL;DR
Google เริ่มปล่อย Gemini 4 Argon ให้กลุ่มพันธมิตรความปลอดภัยไซเบอร์กลุ่มเล็กเมื่อวันพุธที่ 30 กันยายน 2026 และอ้างว่าโมเดลทำคะแนนนำใน benchmark หลายชุด รวมถึงชนะ Astra ของ OpenAI ในชุดที่วัดทักษะความปลอดภัย[1]
แต่พนักงานบางส่วนที่เข้าถึงงานพัฒนาโดยตรงบอกว่า ตัวเลข benchmark ไม่ได้เล่าเรื่องทั้งหมด เพราะเมื่อนำไปใช้งานจริง โมเดลยังติดขัดในงานเขียนโค้ดบางประเภท[1]
เรื่องนี้ไม่ได้เป็นแค่ข่าวซุบซิบในบริษัท เพราะมันชี้ไปที่คำถามใหญ่กว่าว่า คะแนนสอบกับการใช้งานจริง ยังเป็นคนละเรื่องกัน และบริษัทที่แข่งกันด้วยตัวเลข อาจกำลัง optimize ผิดจุด
เกิดอะไรขึ้น
สำนักข่าว Bloomberg รายงานเมื่อวันที่ 30 กันยายน 2026 โดยอ้างพนักงานที่เข้าถึงงานพัฒนาภายในโดยตรง[1][2] รายงานฉบับเดียวกันถูกนำมาเผยแพร่ซ้ำโดยอีกหลายสำนัก ทั้ง The Japan Times [3] Yahoo Finance [5] และ Markets Insider [7]
ภาพที่รายงานออกมาเป็นแบบนี้ Google ประกาศเปิดตัวโมเดลต่อกลุ่มพันธมิตรความปลอดภัยไซเบอร์ที่ไว้ใจได้กลุ่มเล็ก และจะขยายการเข้าถึงหลังทดสอบเพิ่ม โดยเริ่มจากสมาชิกแบบจ่ายเงิน[1]
บริษัทระบุว่า Gemini 4 ทำคะแนนนำใน benchmark หลายชุด รวมถึงชนะ Astra ของ OpenAI ในชุดหนึ่งที่วัดทักษะด้านความปลอดภัย[1]
แต่พนักงานที่รายงานให้ Bloomberg บอกว่า คะแนนพวกนั้นไม่ได้เล่าเรื่องทั้งหมด เมื่อนำโมเดลไปทำงานจริงกลับได้ผลไม่เท่าที่คะแนนบอก และยังติดขัดในงานเขียนโค้ดบางประเภท[1]
สิ่งที่เกิดขึ้นกับราคาหุ้น
จุดที่ทำให้เห็นว่าเรื่องนี้มีน้ำหนักคือปฏิกิริยาของตลาด[1]
หุ้น Alphabet ปรับขึ้นราว 1.7% ในตลาดหลังเวลาเทรด หลังบริษัทประกาศเปิดตัวโมเดล
แต่ในช่วงท้ายของการซื้อขายปกติ หุ้นกลับลดช่วงบวกที่ทำไว้ตอนต้นวันลง หลัง Bloomberg ตีพิมพ์รายงานเรื่องความไม่เชื่อของพนักงาน
Google ตอบว่าอย่างไร
Google แจ้ง Bloomberg ว่า การบอกว่า Gemini 4 ผลงานต่ำในด้านอย่างการเขียนโค้ดไม่ถูกต้อง และให้ย้อนไปดูความเห็นของ Koray Kavukcuoglu หัวหน้า Google DeepMind ที่ให้ไว้เมื่อสัปดาห์ก่อน[1]
Kavukcuoglu พูดในงานประชุมที่จัดโดยสำนักข่าว The Information ว่าเขาเชื่อมั่นในทีมงานมาก และในความเห็นของเขา เป็นเรื่องแน่นอนว่าบริษัทจะอยู่ที่แนวหน้าตลอดไป[1]
สองเสียงจากในบริษัทเดียวกัน
สิ่งที่รายงานฉบับนี้เปิดออกมาชัดกว่าตัวข้อข่าวคือ ความเห็นภายใน Google ไม่ได้เป็นเสียงเดียว[1]
ฝั่งหนึ่งเชื่อว่า Fable ของ Anthropic กับ Astra ของ OpenAI กำลังพัฒนาด้วยความเร็วที่สูงกว่า และเชื่อว่า Gemini 4 ต่อให้ทำได้ดีที่สุดแล้ว ก็ยังตามหลังสองตัวนั้นในบางด้าน
อีกฝั่งหนึ่งเชื่อว่าโมเดลรุ่นที่กำลังจะมาถึงนี้ตามทันห้องแล็บชั้นนำแล้ว
พนักงานคนหนึ่งที่คุ้นกับงานพัฒนาโมเดลบอกว่า ภายในบริษัทมีฉันทามติกว้างว่า Gemini 4 อยู่ในระดับแนวหน้า และบอกว่าบริษัททดสอบโมเดลอย่างเข้มงวด พร้อมปฏิเสธว่าโมเดลไม่ได้มีปัญหาในงานเขียนโค้ดจริงที่ยุ่งเหยิง
จะเห็นว่าเรื่องเดียวกันมีคนในบริษัทเดียวกันตอบไม่ตรงกัน สองคำตอบนี้อยู่บนพื้นที่ของข้อเท็จจริงชุดเดียวกันได้ เพราะคำถามที่แต่ละฝ่ายตอบไม่เหมือนกัน ฝ่ายหนึ่งตอบว่า "โมเดลเก่งที่สุดหรือยัง" อีกฝ่ายตอบว่า "โมเดลเก่งพอหรือยัง"
เมื่อคะแนนสอบไม่เท่ากับการทำงาน
ส่วนที่มีค่าที่สุดของรายงานฉบับนี้คือคำอธิบายว่า ทำไมเรื่องแบบนี้ถึงเกิดซ้ำกับหลายห้องแล็บ[1]
ปรากฏการณ์นี้มีชื่อเล่นในวงการว่า benchmaxxing คือการที่วิศวกรไปให้ความสำคัญกับการทำคะแนนให้สวยมากกว่าการสร้างของที่ทำงานได้ดีจริง
สาเหตุที่ห้องแล็บทำแบบนั้น เพราะลูกค้าส่วนใหญ่ตัดสินโมเดลจากคะแนน benchmark นั่นเอง พนักงานสองคนที่คุ้นกับโมเดลบอกว่า Gemini 4 ได้รับผลจากกระบวนการนี้[1]
Edwin Chen ผู้ก่อตั้ง Surge AI อธิบายปรากฏการณ์นี้ด้วยอุปมาที่เข้าใจง่ายว่า "นึกภาพว่า โอเค ลูกผมได้คะแนน SAT ดีมาก แต่ SAT ไม่ได้แปลงไปเป็นผลงานในโลกจริง" และบอกว่านี่เป็นปัญหาที่ร้ายกาจมาก[1]
ผลที่ตามมาตามคำอธิบายของเขาคือ เมื่อห้องแล็บยึดคะแนนเป็นเป้า มันจูงให้ทีมไปสร้างโมเดลที่เขียนโค้ดในภาษาที่ใช้สอบได้เก่ง แทนที่จะสร้างแอปที่ใช้งานง่ายหรือออกแบบมาดี[1]
จุดที่ Gemini 4 ยังไม่ถนัด
รายงานระบุจุดที่อ่อนไว้ชัดเจน โดยอ้างคนที่คุ้นกับการประเมินภายในว่า ความสามารถด้านการเขียนโค้ดของ Gemini 4 ไม่สม่ำเสมอ[1]
อีกจุดคือการออกแบบส่วนหน้า หรือหน้าตาของแอปกับเว็บไซต์ ซึ่งคนหนึ่งบอกว่า Gemini ยังไม่ถนัดเป็นพิเศษ
จุดนี้สำคัญกว่าที่คิด เพราะงานออกแบบส่วนหน้าเป็นส่วนที่ผู้ใช้มองเห็นและตัดสินจากมันโดยตรง และเป็นสนามที่ Google เองก็ยังแข่งกับเครื่องมือเขียนโค้ดของเจ้าอื่นได้ไม่เต็มที่[1]
ข้อสังเกตอีกข้อคือ โมเดลนี้มีขนาดใหญ่มาก และโมเดลใหญ่ปกติมีต้นทุนการรันสูง ซึ่งอาจกดดันอัตรากำไรของบริษัท[1]
ด้านที่ Gemini 4 ทำได้ดี
การเขียนถึงแต่จุดอ่อนจะไม่ยุติธรรมกับโมเดล เพราะรายงานฉบับเดียวกันยกด้านที่ทำได้ดีไว้ด้วย พอสรุปเป็นข้อ ๆ ได้ว่าจุดเด่นที่รายงานยกมาคือเรื่องการตีความวิดีโอ ความปลอดภัย ความมั่นคงไซเบอร์ และการสื่อสาร[1]
พนักงานคนหนึ่งบอกว่า Gemini 4 โดดเด่นเรื่องการตีความข้อมูลที่ไม่ใช่ข้อความ เช่นการดึงข้อมูลกำกับออกจากวิดีโอ
ด้านอื่นที่รายงานยกมาคือความปลอดภัย ความมั่นคงไซเบอร์ และความสามารถสื่อสารได้ชัดเจนและเป็นธรรมชาติ
Google เองระบุว่า Gemini 4 ถูกสร้างมาสำหรับงานยาวและซับซ้อนในด้านวิศวกรรมซอฟต์แวร์ การเงิน กฎหมาย และความมั่นคงไซเบอร์ โดยให้ผลลัพธ์ยาวได้ถึง 1 ล้านโทเคนต่อครั้ง หรือราว 750,000 คำ[1]
ราคาที่ Google จ่ายไปก่อนถึงวันนี้
เพื่อให้เห็นว่าทำไมความไม่แน่ใจครั้งนี้ถึงมีน้ำหนัก ต้องดูว่าก่อนหน้านี้ Google แบกอะไรไว้[1]
Google ประกาศรุ่นชื่อ Gemini 3.5 Pro ที่งานประชุม I/O ในเดือนพฤษภาคม และให้สัญญาว่าจะปล่อยในเดือนถัดมา แต่กำหนดเวลานั้นผ่านไป และบริษัทก็ทิ้งแผนรุ่นนั้นไปในที่สุด
การตัดสินใจทิ้งงานเทรนที่ทำไปแล้วมีต้นทุนจริง Mandeep Singh นักวิเคราะห์จาก Bloomberg Intelligence ประเมินว่า การเทรนโมเดลขนาดนี้หนึ่งรอบอาจใช้เงินสูงถึง 400 ล้านดอลลาร์ หรือราว 13,467 ล้านบาท[1][4]
เมื่อเทียบกับเรตอ้างอิง 33.67 บาทต่อดอลลาร์เมื่อวันที่ 2 ตุลาคม 2026 ตัวเลข 400 ล้านดอลลาร์คิดเป็นราว 13,467 ล้านบาท[4]
และถ้าใช้ทีมนักวิจัย AI ที่ค่าตัวสูง ต้นทุนก็ยิ่งบวกเพิ่มขึ้นไปอีก
อีกเรื่องที่รายงานยกมาคือการจากไปของนักวิจัยชื่อดังหลายคน รวมถึง Jeff Dean วิศวกรระดับตำนาน John Jumper ผู้ได้รับรางวัลโนเบล และ Noam Shazeer หนึ่งในผู้คิดค้นเทคโนโลยีที่เป็นฐานของความก้าวหน้า AI ในยุคนี้[1]
เดือนสิงหาคมที่ผ่านมา Demis Hassabis ซึ่งนำงานวิจัย AI ของบริษัทมานาน ได้รับบทบาทใหม่เป็นประธาน และส่งงานบริหารประจำวันของ DeepMind ให้ Kavukcuoglu ซึ่งเป็นมือขวาที่ทำงานด้วยกันมานาน[1]
ความไม่พอใจที่สะสมมาไม่ได้เพิ่งเริ่มที่ Gemini 4 รายงานเมื่อเดือนมิถุนายน 2026 ระบุว่า วิศวกร Google บางส่วนใช้มีมล้อเครื่องมือ AI ภายในบริษัท โดยข้อร้องเรียนหลักมีสามเรื่อง คือข้อมูลที่แต่งขึ้น การรีวิวโค้ดที่กลายเป็นภาระมากกว่าช่วย และความล่าช้าหลายเดือนของโมเดลหลัก ซึ่งรวมถึงผลงานด้านการเขียนโค้ดของ Gemini 3.5 Pro ที่ต่ำกว่าเกณฑ์ภายในของ Google เอง[6]
ทำไมเรื่องนี้สำคัญกับคนทำงาน
ผลิตภัณฑ์ที่ต้องพึ่งโมเดลนี้
Google ต้องการให้ Gemini 4 สำเร็จอย่างมาก เพราะโมเดลตระกูลนี้เป็นฐานของผลิตภัณฑ์เกือบทุกตัวที่บริษัทขาย[1]
เริ่มจากคำตอบ AI ที่อยู่บนหน้า Search ซึ่งเป็นเครื่องทำกำไรหลักของบริษัท ไปจนถึง Maps, Gmail และ Chrome
แต่ละตัวมีผู้ใช้มากกว่าหนึ่งพันล้านคน ซึ่งเป็นข้อได้เปรียบเรื่องช่องทางจำหน่ายที่คู่แข่งบางรายไม่มี[1]
แต่ในเวลาเดียวกัน OpenAI กับ Anthropic กำลังขยับจากธุรกิจขายโมเดลไปสู่การสร้างผลิตภัณฑ์ของตัวเอง รวมถึงเอเจนต์สำหรับเขียนโค้ด[1]
Google ให้ข้อมูลกับ Bloomberg ว่า แม้โมเดล Pro ตัวล่าสุดจะเปิดตัวเมื่อเดือนกุมภาพันธ์ แต่บริษัทเห็นการเติบโตในผลิตภัณฑ์ AI หลังจากนั้น ทั้งเวอร์ชันองค์กรของ Gemini แอปแชตสำหรับผู้ใช้ทั่วไป และ AI Mode ใน Google Search โดยสองตัวหลังมีผู้ใช้เกินหนึ่งพันล้านคนแล้ว[1]
ถ้าคะแนนยังเป็นตัวตัดสิน
สำหรับคนที่ต้องเลือกเครื่องมือทำงาน สิ่งที่รายงานนี้บอกไม่ใช่ "อย่าใช้ Gemini 4" แต่เป็นการเตือนว่าคะแนนที่เห็นบนหน้าเปรียบเทียบ กับผลลัพธ์ในงานจริง เป็นคนละหน่วยวัด
ผมเคยเขียนไว้ในบทความก่อนหน้าเกี่ยวกับ Gemini 4 ว่า รายงานของ Bloomberg เรื่องความเห็นพนักงานภายในเป็นข้อมูลจากแหล่งไม่เปิดเผยชื่อที่ Google ปฏิเสธ และเป็นเรื่องการใช้งานระยะสั้น ไม่ใช่ผลทดสอบที่เผยแพร่ต่อสาธารณะ
รายงานฉบับเต็มทำให้เห็นภาพชัดขึ้นอีกชั้น ว่าความเห็นที่ขัดกันนั้นไม่ได้มาจากสองบริษัท แต่มาจากคนในบริษัทเดียวกัน และการตัดสินใจว่าจะเชื่อฝั่งไหน ขึ้นกับว่างานของคุณต้องใช้โมเดลทำอะไร
ข้อควรระวัง
ผมไม่ได้ทดลองใช้ Gemini 4 และตอนนี้ก็ยังไม่มีช่องทางให้คนทั่วไปเข้าถึงได้ ข้อเท็จจริงของเหตุการณ์หลักในบทความนี้มาจากรายงานของ Bloomberg ที่ The Star นำมาเผยแพร่ซ้ำ[1][2] ส่วนการแปลงราคาเป็นบาทมาจากเรตอ้างอิงที่ผมดึงเอง[4] และรายงานเรื่องการที่พนักงานใช้มีมล้อเครื่องมือ AI ในเดือนมิถุนายน 2026 มาจาก CryptoBriefing[6]
จุดที่ต้องระวังที่สุดคือ รายงานอิงพนักงานที่ไม่เปิดเผยชื่อทั้งหมด และ Google ปฏิเสธข้อกล่าวเรื่องผลงานด้านการเขียนโค้ด บทความนี้จึงไม่สามารถยืนยันได้ว่าฝั่งไหนถูก
ตัวเลข 400 ล้านดอลลาร์เป็นประมาณการของนักวิเคราะห์ ไม่ใช่ตัวเลขที่ Google เปิดเผย และราคาแปลงเป็นบาทเป็นการคำนวณของผมจากเรตอ้างอิง ไม่ใช่ตัวเลขที่ Bloomberg รายงาน
การประเมินว่าโมเดลเก่งหรือไม่ เป็นเรื่องที่ตัดสินด้วยการใช้งานจริงเท่านั้น ตัวเลข benchmark และความเห็นจากแหล่งไม่เปิดเผยชื่อต่างมีข้อจำกัดของตัวเอง
สรุป
ข่าวนี้ไม่ได้บอกว่า Gemini 4 แย่ และไม่ได้บอกว่า Google กำลังแพ้ มันบอกว่าบริษัทที่แข่งกันด้วยคะแนน benchmark กำลังเจอคำถามเดิมที่วงการซอฟต์แวร์เจอมาก่อน คือของที่ทำคะแนนได้ดีที่สุด ไม่ได้แปลว่าเป็นของที่ทำงานได้ดีที่สุดเสมอไป
คำถามที่ตรงกว่าคือ ถ้าคะแนนสอบกับงานจริงไม่ตรงกัน แล้วอะไรคือตัววัดที่ควรใช้แทน
ถ้าทีมของคุณกำลังประเมินโมเดลสำหรับงานเขียนโค้ด หรือกำลังรอ Gemini 4 เปิดให้ใช้ทั่วไป ลองทำสองอย่างก่อนตัดสินใจ อย่างแรกคือใช้โจทย์จากงานจริงของทีมเอง ไม่ใช่โจทย์ตัวอย่างของคู่มือ อย่างที่สองคือจับผลลัพธ์ที่ต้องแก้ตามหลัง ไม่ใช่จับแค่ความเร็วที่โมเดลตอบ เพราะสองตัวเลขนี้จะบอกได้ตรงกว่าคะแนนบน leaderboard
พี่ตูนอ่านแล้วเห็นว่ามุมไหนของเรื่องนี้มีค่ากับคนทำงานไทยมากที่สุดครับ
REF
[1] The Star (เผยแพร่ซ้ำจาก Bloomberg), "Google grapples with employee scepticism about new Gemini 4" (รายงานของ Julia Love และ Davey Alba · ปล่อย Argon ให้พันธมิตรความปลอดภัยกลุ่มเล็กเมื่อวันพุธที่ 30 กันยายน 2026 · Alphabet ปรับขึ้นราว 1.7% ในตลาดหลังเวลาเทรด แล้วลดช่วงบวกช่วงท้ายของการซื้อขายปกติหลัง Bloomberg ตีพิมพ์รายงาน · Google แจ้งว่าการบอกว่าโมเดลผลงานต่ำด้านการเขียนโค้ดไม่ถูกต้อง · คำพูดของ Koray Kavukcuoglu ที่งานประชุมของ The Information · พนักงานเชื่อ Fable และ Astra พัฒนาเร็วกว่า · พนักงานอีกฝั่งบอกมีฉันทามติกว้างว่า Gemini 4 อยู่ที่แนวหน้า · คำอธิบาย benchmaxxing และคำพูดของ Edwin Chen ผู้ก่อตั้ง Surge AI · จุดอ่อนด้านการเขียนโค้ดที่ไม่สม่ำเสมอและการออกแบบส่วนหน้า · จุดแข็งเรื่องการตีความวิดีโอ ความปลอดภัย และการสื่อสาร · Google ทิ้งแผน Gemini 3.5 Pro ที่สัญญาไว้ที่งาน I/O เดือนพฤษภาคม · ประมาณการต้นทุนการเทรน 400 ล้านดอลลาร์ของ Mandeep Singh นักวิเคราะห์ Bloomberg Intelligence · การจากไปของ Jeff Dean, John Jumper และ Noam Shazeer · เดือนสิงหาคม Demis Hassabis เป็นประธานและ Kavukcuoglu ดูแลงานประจำวันของ DeepMind · ผลิตภัณฑ์ที่พึ่งโมเดลตระกูลนี้มีผู้ใช้เกินหนึ่งพันล้านคนแต่ละตัว · Google ระบุว่าผลลัพธ์ยาวได้ถึง 1 ล้านโทเคนหรือราว 750,000 คำ), 2 ตุลาคม 2026. https://www.thestar.com.my/tech/tech-news/2026/10/02/google-grapples-with-employee-scepticism-about-new-gemini-4
[2] Bloomberg, "Google Grapples With Employee Skepticism About New Gemini 4" (ต้นฉบับของรายงาน · เผยแพร่ 30 กันยายน 2026 เวลา 19:52 UTC แก้ไขล่าสุด 21:05 UTC), 30 กันยายน 2026. https://www.bloomberg.com/news/articles/2026-09-30/google-grapples-with-employee-skepticism-about-new-gemini-model
[3] The Japan Times (เผยแพร่ซ้ำจาก Bloomberg), "Google grapples with employee skepticism about new Gemini 4" (ฉบับที่หน้าเว็บแสดงเป็นฉบับก่อนการเปิดตัว หยุดที่ย่อหน้าเปิดเรื่องที่ระบุว่า Gemini 4 ทำได้ดีใน benchmark ที่วงการใช้วัด แต่ได้ผลน้อยกว่าเมื่อพนักงานนำไปใช้จริง · ไม่มีตัวเลข 1.7% ตัวเลข 750,000 คำ ตัวเลข 1 ล้านโทเคน และคำพูดของ Kavukcuoglu ที่อยู่ในฉบับเต็มของ [1]) 1 ตุลาคม 2026. https://www.japantimes.co.jp/business/2026/10/01/tech/google-employee-skepticism-gemini-4/
[4] ExchangeRate-API, "Open Exchange Rates" (API สาธารณะที่คืนข้อมูล JSON · เรตอ้างอิง 1 ดอลลาร์สหรัฐเท่ากับ 33.667593 บาท ณ วันที่ 2 ตุลาคม 2026 เวลา 00:02 UTC ใช้คำนวณ 400 ล้านดอลลาร์เป็นราว 13,467 ล้านบาทในบทความนี้ · หมายเหตุการเข้าถึง: ปลายทางเป็น JSON ไม่ใช่หน้าเว็บ ขนาดราว 2,970 ไบต์), 2 ตุลาคม 2026. https://open.er-api.com/v6/latest/USD
[5] Yahoo Finance (เผยแพร่ซ้ำจาก Bloomberg), "Google Grapples With Employee Skepticism About New Gemini Model" (เนื้อหาเดียวกับ [1] · ยืนยันข้อความเรื่อง Google ระบุว่าการบอกว่าโมเดลผลงานต่ำด้านการเขียนโค้ดไม่ถูกต้อง · ยืนยันคำพูดของ Kavukcuoglu), 30 กันยายน 2026. https://uk.finance.yahoo.com/news/google-grapples-employee-skepticism-gemini-195242680.html
[6] CryptoBriefing, "Google faces employee skepticism over its Gemini AI models" (รายงานเดือนมิถุนายน 2026 เรื่องวิศวกร Google ใช้มีมล้อเครื่องมือ AI ภายใน · ข้อร้องเรียนสามเรื่องคือข้อมูลที่แต่งขึ้น การรีวิวโค้ดที่กลายเป็นภาระ และความล่าช้าหลายเดือนของโมเดลหลัก · รายงานว่าผลงานด้านการเขียนโค้ดของ Gemini 3.5 Pro ต่ำกว่าเกณฑ์ภายในของ Google เอง · ระบุว่าความไม่พอใจมาจากความกังวลเรื่องการใช้งานจริง ไม่ใช่การประกาศโมเดลใดโมเดลหนึ่ง), 30 กันยายน 2026. https://cryptobriefing.com/google-employee-skepticism-gemini-model/
[7] Markets Insider (TheFly), "Google staff skeptical about performance of new Gemini model, Bloomberg says" (สรุปข่าวธุรกิจของ Bloomberg · อ้างพนักงานที่เข้าถึงงานพัฒนาโดยตรงว่า ผลงานบน benchmark ดี แต่เมื่อนำไปใช้จริงได้ผลน้อยกว่า และยังติดขัดในงานเขียนโค้ดบางประเภท), 30 กันยายน 2026. https://markets.businessinsider.com/news/stocks/google-staff-skeptical-about-performance-of-new-gemini-model-bloomberg-says-1036587836







