Yunit 3 / 10

Sa amin higanteng malalim: anthropic, openai, google

Mga nadagdag:

  • Pagtutugma ng malalakas na field at karaniwang gumagamit ng mga pamilyang Claude, GPT at Gemini
  • Kakayahang basahin ang antas (tier) na lohika at pagpapangalan ng modelo ng bawat provider
  • Ugaliing magbase ng mga paghahambing sa sarili mong data ng pagsubok, hindi sa mga claim sa marketing

Namin ang market at natutunan ang closed/open weight distinction. Ngayon ay makikilala natin ang tatlong pinakanakikitang manlalaro sa merkado, lalo na ang malalaking tagabigay ng serbisyo na nakabase sa US: Anthropic (Claude), OpenAI (GPT) at Google (Gemini). Ang tatlong tampok na ito sa karamihan ng mga pagpapasya ng enterprise AI ngayon. Ang aming layunin ay hindi magdeklara ng isang "nagwagi"; Ang layunin ay upang lubos na maunawaan kung saan nagniningning ang bawat isa, ang lohika ng pagbibigay ng pangalan at ang karaniwang gumagamit nito. Kapag natapos na ang unit, maaari mong pag-usapan ang tungkol sa tatlong pamilyang ito nang hindi nalilito sa kanila at maiisip mo na dapat mong ibase ang isang paghahambing sa iyong sariling pagsubok, hindi sa advertising.

Karaniwang Lohika: Tier System

Ang tatlong provider na ito ay gumagamit ng magkatulad na lohika: nag-aalok sila ng mga modelo sa loob ng parehong pamilya, na naka-tier ayon sa balanse ng bilis/gastos/kapangyarihan. Karaniwang mayroong tatlong tier:

  • Light tier: Pinakamabilis at pinakamura. Para sa simple, mataas na dami ng mga gawain (klasipikasyon, briefing, label).
  • Balanseng yugto: Mid-range na kapangyarihan at gastos. Ang "default" na pagpipilian para sa karamihan ng mga pang-araw-araw na gawain.
  • Malakas na antas: Pinakamahusay, pinakamahal, pinakamabagal. Para sa kumplikadong pangangatwiran, mahabang pagsusuri, mahirap na code.

Kapag naunawaan mo na ang tier na lohika na ito, hindi ka na mawawala kahit na sinong provider ang tingnan mo. "Aling antas ang tumutugma sa modelong ito sa pamilyang ito?" Sapat na ang magtanong.

Tip: Kapag narinig mo ang tungkol sa isang bagong modelo, tanungin muna ang "aling antas ng pamilya?" magtanong. Huwag hayaang takutin ka ng maraming pangalan; Ang bawat provider ay aktwal na nag-aalok ng parehong tatlong tier sa ilalim ng magkakaibang mga pangalan.

Anthropic — Pamilya Claude

Ang pamilya Claude ng Anthropic ay nag-aalok ng tatlong tier na tinatawag na Opus (malakas), Sonnet (balanseng), at Haiku (liwanag). Ang mga numero ng bersyon ay kasama rin; Halimbawa, ang modelong ginamit ng platform na ito ay claude-opus-4-8, iyon ay, ang 4.8 na bersyon ng yugto ng Opus.

Mahusay ito sa: mahabang pagpoproseso ng konteksto (ang kakayahang magbasa ng daang-pahinang mga dokumento sa kabuuan ng mga ito), pagsulat at pagbabasa ng code, at secure, predictable na gawi sa paggamit ng enterprise. Kilala si Claude sa pagiging malapit sa mga tagubilin at pag-arte sa mga sensitibong bagay. Samakatuwid, ito ay madalas na ginusto sa mga kinokontrol na sektor tulad ng batas, pananalapi at kalusugan.

Karaniwang user: Mga legal na team na nagsusuri ng mahahabang dokumento, mga software team na nagsusuri ng code, mga corporate na serbisyo sa customer na nangangailangan ng secure na output.

Mga kasalukuyang modelo ng Anthropic at tinatayang presyo (bawat milyong token, input/output):

modelo

entablado

Konteksto

Input $/1M

Output $/1M

Claude Opus 4.8

malakas

1M token

~5

~25

Claude soneto 5

balanse

1M token

~3

~15

Claude Haiku 4.5

magaan ang timbang

200K token

~1

~5

Pansin: Ang mga presyong ito ay tinatayang para sa panahon kung saan ang modyul na ito ay inihanda at madalas na nagbabago. Tiyaking kumpirmahin ang kasalukuyang page ng presyo ng provider bago gumawa ng desisyon. Tatalakayin namin ang lohika ng presyo nang detalyado sa ika-6 na yunit.

Openai — pamilya ng gpt

Ang pamilya ng GPT ng OpenAI ay ang pinaka kinikilalang tatak sa merkado at may pinakamalaking third-party na ecosystem; ibig sabihin, maraming software tool, plug-in at integration ang unang inilabas para sa GPT. Ang pamilya ng GPT ay may tiered din: may mga mabilis at murang modelo (mga magaan na opsyon tulad ng GPT-4o mini, halimbawa), mga balanseng all-round na modelo (GPT-4o), at mga modelong mabigat sa pag-iisip tulad ng "o-series" na partikular na nakatuon sa pangangatwiran.

Mga lugar kung saan ito namumukod-tangi: Versatility at prevalence. Malawak na hanay ng mga kakayahan para sa teksto, code, mga imahe at audio; mature na ekosistema ng sasakyan; at malawak na suporta sa komunidad. "Maaari bang gawin ang isang trabaho sa AI?" Ang GPT ay karaniwang isang handa na panimulang punto.

Karaniwang user: Mga startup na gumagawa ng mabilis na prototyping, mga team ng produkto na gustong malawak na pagsasama, mga SMB na gustong humawak ng malawak na hanay ng mga gawain sa isang provider.

Google — Pamilya Gemini

Ang pamilya Gemini ng Google ay naglalaro gamit ang dalawang makapangyarihang card: multimodality (ang kakayahang pangasiwaan ang text, mga larawan, audio, at video nang magkasama) at Google Workspace integration (trabahong naka-embed sa mga tool tulad ng Gmail, Docs, Sheets). May tier din ang Gemini: may mga mabibilis na "Flash" na modelo at mas makapangyarihang "Pro" na mga modelo.

Kung saan ito mahusay: Pag-unawa sa visual at video, malawak na konteksto, at walang alitan na pagsasama para sa mga organisasyong gumagamit na ng mga tool ng Google nang husto. Kung pinapatakbo ng isang organisasyon ang lahat ng gawaing pang-opisina sa Google Workspace, nararanasan nito ang Gemini bilang natural na extension.

Karaniwang user: Mga kumpanyang itinatag sa ecosystem ng Google, mga pangkat ng nilalamang mabigat sa larawan/video, mga gustong magproseso ng napakalaking set ng data nang sabay-sabay.

Tatlong Pamilyang Magkatabi

Sukat

Anthropic (Claude)

OpenAI (GPT)

Google (Gemini)

pinakamatibay na aspeto

Mahabang konteksto, code, ligtas na pag-uugali

Kakayahan, malawak na ekosistema

Multimodality, Workspace

Mga yugto

Opus/Sonnet/Haiku

Malakas / balanse / magaan + pangangatwiran

Pro/Flash

Karaniwang gumagamit

Mga kinokontrol na sektor

Mga pangkat ng negosyo at produkto

Mga institusyong nakatuon sa Google

Uri ng timbang

sarado

sarado

sarado

Kapag tumitingin sa talahanayang ito, huwag magtanong "alin ang mananalo"; Itanong "Aling row ang tumutugma sa trabaho ko?" Kung ikaw ay nagkakaroon ng 200-pahinang kontrata na nagbabasa, ang mahabang linya ng konteksto ay mapagpasyahan para sa iyo, at kung nagkakaroon ka ng mga invoice na nabasa mula sa isang visual, ang multimodality na linya ay mapagpasyahan para sa iyo.

Mahina Prompt / Malakas na Prompt: Kapag Humihingi ng Pampamilyang Pagpipilian

Mahinang prompt:

Alin ang mas maganda: Claude, GPT o Gemini?

Napakahusay na prompt:

Ang iyong tungkulin: neutral na consultant ng AI. Ang aking trabaho: Gusto kong gumawa ng mga draft para sagutin ang mga email ng customer sa isang e-commerce na kumpanya + kunin ang halaga/petsa mula sa mga papasok na larawan ng invoice. Mayroong dalawang magkaibang gawain: (1) pagbuo ng teksto, (2) pagkuha ng data mula sa larawan. Gawain: Ikumpara ang pamilya Claude, GPT at Gemini para sa parehong gawain. Isulat kung aling pamilya ang namumukod-tangi batay sa gawain, aling antas ang dapat kong gamitin at bakit. Huwag magbigay ng eksaktong presyo, magbigay ng saklaw. Kapag may pagdududa, sabihin ang "test".

Dahil hinahati ng pangalawang prompt ang trabaho sa dalawang malinaw na gawain, maaaring irekomenda ng modelo ang tamang pamilya para sa bawat gawain nang hiwalay. Ito rin ang batayan para sa ideyang "modelo portfolio" na malalaman natin mamaya.

Mga Kopyadong Template

Pagtutugma ng Tier 1:

Tinukoy ko ang sumusunod na gawain: [GAWAIN]. Kung isasaalang-alang ang antas ng kahirapan at lakas ng tunog, aling tier ng mga pamilyang Claude, GPT at Gemini (magaan/balanseng/malakas) ang irerekomenda mo? Sumulat ng isang linya ng pagbibigay-katwiran para sa bawat pamilya.

2. Pagkatugma sa ekosistema:

Mga tool na kasalukuyang ginagamit namin: [TOOL LIST, hal. Google Workspace / Microsoft 365].Aling pamilya ng AI ang pinakakasya sa tool stack na ito at bakit? Suriin ang kadalian ng integration, learning curve, at posibleng panganib ng lock-in (dependency).

3. Pagpapatunay ng lakas:

Gusto kong subukan ang claim na "[MODEL NAME] ang pinakamagaling dito" para sa aking gawain [TASK]. Aling 3 sample na pagsubok ang dapat kong patakbuhin sa sarili kong kahusayan upang i-verify ang claim na ito? Ilarawan ang pamantayan ng tagumpay para sa bawat pagsusulit sa isang pangungusap.

4. Resolusyon ng pangalan:

I-parse ang mga sumusunod na pangalan ng modelo sa pamilya, entablado at bersyon at gumawa ng talahanayan: [MODEL NAMES]. Lagyan ng label ang isang karaniwang gamit para sa bawat isa ng isang salita.

Mga karaniwang pagkakamali

  • Pagpapasya batay sa advertising: Ang anunsyo na "Nauna ang modelong ito sa pagsubok na iyon" ay maaaring walang sabihin tungkol sa iyong misyon. Subukan ito gamit ang iyong sariling data.
  • Pagpili ng pamilya nang hindi pumipili ng antas: Hindi sapat na sabihing "Gagamitin namin ang GPT"; Aling antas ito ay lubhang nagbabago sa gastos at kalidad.
  • Pagbabalewala sa lock ng ecosystem: Ang pagiging malalim na nakatuon sa isang pamilya ay nagdudulot ng kadalian ng pagsasama ngunit nagiging mahirap na lumipat sa ibang provider sa hinaharap.
  • Nawawala ang paksa: Mabilis na nagbabago ang merkado na ito; Ang paghahambing mula sa anim na buwan na nakalipas ay maaaring hindi wasto ngayon. Ibase ang iyong desisyon sa napapanahong impormasyon.
  • Pagpipilit sa isang pamilya na gawin ang lahat: Habang kumikinang ang isang pamilya sa text, maaaring nauna ang isa pang pamilya sa visual. Mag-isip ng gawain sa bawat gawain.

Sa buod

  • Ang Anthropic, OpenAI, at Google ay nag-aalok ng parehong tier logic (light/balanced/strong) sa ilalim ng magkakaibang pangalan.
  • Claude sa mahabang konteksto, code at secure na pag-uugali ng korporasyon; Ang GPT ay may mahusay na versatility at malawak na ecosystem; Napakahusay ng Gemini sa multimodality at integration ng Workspace.
  • Ang "Pinakamahusay" ay nag-iiba ayon sa trabaho; ibabatay ang paghahambing sa iyong sariling data ng pagsubok, hindi sa advertising.
  • Ang pag-parse ng mga pangalan ng modelo sa bersyon ng pamilya + tier + ay makakatulong sa iyong mahanap ang iyong paraan sa masikip na merkado.

Gawain ng aplikasyon

Tukuyin ang dalawang magkaibang gawain sa iyong trabaho (isang text-heavy, isang visual- o long-document-heavy). Gamit ang template 1 (tier matching) sa unit na ito, ipatanong sa isang AI model ang naaangkop na ranggo ng tatlong pamilya para sa bawat gawain. Pagkatapos, gamit ang template 3 (strengths validation), magdisenyo ng tatlong kongkretong pagsubok para subukan ang iminungkahing modelo gamit ang sarili mong data. Gagamitin namin ang mga pagsusulit na ito sa pag-aaral ng pagsusuri sa yunit 10.

checklist

  • [ ] Nakikilala ko ang antas (magaan/balanse/malakas) na lohika sa lahat ng tatlong pamilya.
  • [ ] Claude, mapapantayan ko ang mga lugar kung saan prominente ang GPT at Gemini.
  • [ ] Maaari akong pumili ng tamang pamilya at ranggo para sa isang gawain na may katwiran.
  • [ ] Alam ko ang mga paraan upang subukan ang isang claim ng modelo gamit ang sarili kong data.
  • [ ] Maaari kong i-parse ang mga pangalan ng modelo bilang pamilya + yugto + na bersyon.