Eszközök/MI-ágensek

Aider teszt: git-first párprogramozás a terminálon

Az Aider 0.86.2 tesztje: Apache-2.0-s terminálos párprogramozó, amelynek benchmarkja őszintén rangsorolja a modelleket, és amelynek megállt a kiadási üteme.

Típus
Coding agent
Ár
Free · BYO API key

··10 perc olvasás

  • Coding agent
  • Terminal
  • Git workflow
  • BYO key
  • Open source
Borítókép az Aider-teszthez: egy terminálmunkamenet, amely egyetlen kérést egy sor git committá alakít

A lényeg röviden

  • Az Aider 0.86.2 2026. február 12-én jelent meg, és ez az egyetlen kiadás 2025 augusztusa óta; a PyPI-n egyetlen személy szerepel karbantartóként.
  • A polyglot benchmark 225 Exercism-feladatot futtat, és a pontszám mellé kiírja a teljes futás dollárköltségét — több átláthatóság, mint amit a legtöbb modellrangsortól lát az ember.
  • A benchmark legfrissebb bejegyzései 2025. október 3-ai dátumúak, így a lista nem tudja értékelni a 2026-ban megjelenő modelleket.
  • Minden sikeres szerkesztés generált üzenetű git committá válik; a review normális marad, az előzmény viszont zajos, amíg össze nem vonják.
  • A kontextust a fejlesztő állítja össze, nem az eszköz: a tokenköltség így kiszámítható, a fájlokon átívelő keresés viszont kézi munka marad.

Az Aider egy Apache-2.0 licencű terminálos párprogramozó: a fejlesztő leírja a változtatást, az Aider módosítja a rendelkezésre álló fájlokat, és commitolja az eredményt. Az itt képviselt álláspont az, hogy 2026-ban is ez a legjobban megtervezett a szabad kódoló CLI-k között egyetlen feladatra — ellenőrizhető, átnézhető módosításokra egy meglévő repón belül —, és hogy a problémája nem a minőség, hanem a lendület: egy kiadás 2025 augusztusa óta, és egy benchmark-oldal, amelynek legfrissebb bejegyzései egy évesek.

A Claude Code-dzsal, a Cursorral, a Cline-nal és az editorba integrált asszisztensekkel verseng, de más feltételek mellett. Ezek a termékek egy modellt egy olyan ügynökbe csomagolnak, amely tervez és feladatokat hajt végre; az Aider szerkesztési protokollt kínál. A fejlesztő megtartja a modellválasztást, az editort és az előzmények alakját — éppen ezért szólít meg olyan csapatokat, amelyeknek már van review-folyamatuk, és éppen ezért okoz csalódást azoknak, akik azt várják, hogy az eszköz egyedül fejezze be a munkát.

Mi ez

A dizájn szűk és tudatos. Az Aider egy shellben fut egy git-repón belül, feltérképezi a kódbázist, hogy eldöntse, mit kell a modellnek látnia, és a modell válaszát fájlmódosításként alkalmazza, nem chatszövegként. A beszélgetés a bemenet, a diff a termék.

  • Apache-2.0 licenc, a PyPI-n aider-chat csomagként, jelenlegi kiadás 0.86.2 (2026. február 12.), Python 3.10–3.12.
  • Körülbelül 49.400 star, 5000 fork és 13.138 commit a GitHubon, továbbá mintegy 1400 nyitott issue és 517 nyitott pull request.
  • A szolgáltató munkamenetenként vagy konfigurációs fájlonként választható: OpenAI, Anthropic, Gemini, DeepSeek, xAI, Azure, Bedrock, Vertex, OpenRouter, GitHub Copilot, Ollama vagy bármely OpenAI-kompatibilis végpont.
  • A repótérkép tree-sitter elemzésből épül, és minden kéréssel együtt utazik, így a modell látja a definíciókat anélkül, hogy a teljes fa a chatbe kerülne.
  • A szerkesztések abban a formátumban alkalmazódnak, amelyre a modell választva van: teljes fájl, diff, keretezett diff vagy architect mód, amely a tervezést és a szerkesztést két modellre osztja.
  • Minden sikeres változás generált üzenetű git committá válik, és a lint- és tesztparancsok minden szerkesztés után lefuthatnak, hibaik pedig visszakerülnek a chatbe.
  • A watch mód a AI! és AI? megjegyzésekre reagál a fájlokban, így változtatás kérhető a szerkesztőből is, ablakváltás nélkül.

Kettő következik ebből a dizájnból. A review normális git marad: az AI-munka egysége a commit, így a revert, a bisect és a blame továbbra is működik a gép által írt kódon is. Az Aider pedig nem tart fenn állapotot a repón túl — nincs felhőprojekt, nincs szerveroldali index, nincs fiók —, ami olcsóvá teszi az átvételt, és a kontextuskezelést teljesen a fejlesztőnél hagyja.

Hogyan működik

Minden kör három dolgot küld a modellnek: az előzményeket, a munkamenet fájljait és a repótérképet. A térkép a repó definícióinak rangsorolt vázlata, amelyet a startüzenetben kiírt token-kör korlátoz; így dolgozik az Aider egy a kontextusablaknál nagyobb kódbázison, anélkül hogy azt állítaná, mindet elolvasta volna.

How one Aider turn runsEvery turn sends the request, the repository map and the files added to the session to the model, which answers in an edit format; Aider applies the diff, runs the lint and test commands and commits the change. Failures from lint or tests go back into the chat and the loop repeats. The engineer chooses which files are added to the session.One Aider turnthe diff is the productEVERY TURNRequestplain wordsContextmap plus added filesModeldiff or architectApplythe edit landsAFTER THE EDITfailures re-enter the chatLint and testnon-zero exits loop backGit commitgenerated messageOrdinary gitdiff, revert, bisect, blameOnly the files the engineer adds are resent; the repository map is rebuilt each turn.Aider reports token limits, it never enforces them
A modell sosem látja a teljes repót: egy térképet, a munkamenet fájljait és azt a diffet, amelyet maga hozott létre.

A kör a fejlesztő egyébként is megbízott ellenőrzéseivel zárul. A lint- és tesztparancsok minden szerkesztés után lefutnak, a nem nulla visszatérési érték a chatbe érkezik javítandó hibaként, és a commit a javítás után következik. Az Aider semmit sem kényszerít ki: a saját hibaelhárítási oldala szerint csak a szolgáltató visszaadott token-limithibáit jelzi, a kiírt token-számok pedig becslések.

Első lépések

A telepítés két parancs. Az alábbi munkamenet a teljes munkafolyamat: indulás a repóban, a modell megnevezése, a szerkesztendő fájlok átadása, valamint a lint- és tesztparancsok hozzáfűzése, amelyek amúgy is lefutnának. A kulcsok a környezetből vagy az api-key kapcsolóból érkeznek.

python -m pip install aider-install
aider-install

cd your-repo
export ANTHROPIC_API_KEY=sk-ant-...

# name the files to edit; everything else stays out of the context
aider src/billing/invoice.py src/billing/tax.py \
  --model sonnet \
  --lint-cmd "ruff check" \
  --test-cmd "pytest -q" --auto-test

Két szokás választja el a gazdaságos munkamenetet a drágától. Csak a tényleg szerkesztendő fájlokat szabad hozzáadni, mert a hozzáadott fájlokat minden körben újraküldi; és azok a modellek előnyösebbek, amelyek diffel válaszolnak, azok helyett, amelyeknek teljes fájlokat kellene újraírniuk, mert a kimeneti token az, amelyen egy nagyobb változtatás előbb fennakad. Ha egy módosítás több fájlt érint, mint amennyit egy prompt elbír, az architect mód egy tervező és egy szerkesztő modellt állít a feladatra.

Mennyibe kerül tényleg

Az eszköz ingyenes, így a teljes számla az API-számlára esik, és a modellválasztás lesz az egyetlen igazán számító költségkontroll. A projekt saját benchmarkja a pontszám mellé kiírja a teljes futás költségét, így ez a legkevésbé hipotetikus költségadat, ami ehhez a munkához létezik:

  • Egy teljes, 225 feladatos futás gpt-5-tel, magas reasoningszinten 29,08 dollárba került, és 88,0%-ot teljesített.
  • Ugyanez a futás Gemini 2.5 Pro-val és 32 000 thinking tokennel 49,88 dollárba került 83,1%-ért.
  • A DeepSeek-V3.2 reasoner módban 74,2%-ot ért el 1,30 dollárért, chat módban pedig 70,2%-ot 0,88 dollárért.
  • A claude-3-7-sonnet thinking nélkül 60,4%-ot teljesített 17,72 dollárért — jó illusztrációja annak, hogy a több költés nem ugyanaz, mint a jobb szerkesztés.
  • Az Aider kezdőoldala heti körülbelül 15 milliárd tokenről számol be, amelyet a felhasználói dolgoznak fel; a szám önbejelentés, de jelzi a nagyságrendet.

Egy munkanap messze ezek alatt a számok alatt marad, hiszen egy benchmark 225 feladatot futtat le a végéig, de a forma megmarad: minden kör a repótérképet és a munkamenet fájljait fizeti, függetlenül attól, hogy a szolgáltató gyorsítja-e az előtagot. A munkamenetek tisztasága a költségkeret.

Az ajánlás mögött álló benchmark

A publikált ranglista ezen a területen szokatlan, mert az eszköz helyett a modellt méri: 225 Exercism-feladat C++, Go, Java, JavaScript, Python és Rust nyelveken, végigoldva, két teljesítési aránnyal, a jól formázott szerkesztési formátumú válaszok arányával és a futás dollárköltségével. A módszertan a commit-hash-ig dokumentált, és ezért visznek súlyt a projekt modellajánlásai.

ModellTeljesítési arányA futás költségeSzerkesztési formátum
gpt-5, magas reasoning88,0%29,08 $diff
Gemini 2.5 Pro, 32k thinking83,1%49,88 $diff-fenced
o3 high, gpt-4.1 szerkesztővel78,2%17,55 $architect
DeepSeek-V3.2 reasoner74,2%1,30 $diff
claude-3-7-sonnet, thinking nélkül60,4%17,72 $diff

A fenntartás a frisség. Az oldal legfrissebb bejegyzései 2025. október 3-ai dátumúak, így az, aki 2026 októberében olvas, egy éves ranglistát néz olyan modellekről, amelyeket azóta leváltottak. A módszer értékes marad, a tábla nem, és aki ebből választ modellt, a tavalyi polcon vásárol.

Miben gyenge

A gyengeségek szerkezetiek. A kontextust kézzel állítják össze: a repótérkép megmutatja a definíciókat, de egy olyan módosítás, amely egy ismeretlen alrendszert érint, továbbra is attól függ, hogy a fejlesztő tudja, mit kell hozzáadni, és az eszköz semmi nem tervez munkát fájlokon át. A funkciókészlet a szerkesztésnél ér véget — a dokumentáció tartalmaz lintelést, teszteket, hangbemenetet, képeket és watch módot, de nincs oldala MCP-kiszolgálóknak, bővítményeknek vagy skill-rendszernek; a fájlszerkesztésen kívüli mindent a fejlesztő köt össze. Aztán ott a tempó: a PyPI egyetlen személyt nevez meg a csomag karbantartójaként, az előző kiadás hat hónapot vett igénybe, és mintegy 1400 issue és 517 pull request van nyitva.

EszközHol futModellválasztásMennyibe kerül
AiderTerminal, bármely editorBármely szolgáltató vagy helyi modellIngyenes, csak API-fogyasztás
Claude CodeTerminalClaude-modellekAPI-fogyasztás vagy előfizetés
CursorSaját editoraA szolgáltató modelljeiElőfizetés
ClineVS Code-bővítményA legtöbb szolgáltató, saját kulcsIngyenes, csak API-fogyasztás

Ezt a táblát kontrollról szóló állításként kell olvasni, nem képességről. A Claude Code és a Cursor többet végez el feladatból felhívás nélkül, és az ára a szűkebb modellválaszték, a Cursor esetében pedig egy a szolgáltató tulajdonában lévő editor. Az Aider ajánlata ennek a tükörképe — maximális kontroll a folyamat felett, minimális termék körülötte —, és pontosan az a csapat akarja, amely egyébként is minden diffet átnéz.

Ítélet

Az Aider a megfelelő terminálos ügynök azoknak a fejlesztőknek, akik szerkesztési protokollt akarnak autonóm kolléga helyett, és nem a megfelelő azoknak, akik arra számítanak, hogy egy eszköz a feladatot a jegytől a merge-elt pull requestig viszi. A mérnöki munkája — szerkesztési formátumok, repótérkép, benchmark, git-fegyelem — továbbra is a mező nagy része előtt jár. A kockázat a projekt dinamikájában van, ezt pedig a licenc nem enyhíti.

  1. Akkor válaszd, ha minden változtatásnak átnézhető commitnak kell lennie, és az AI-szerkesztéseknek a naplóban pontosan úgy kell kinézniük, mint az emberi változtatásoknak.
  2. Akkor válaszd, ha a modellválasztás követelmény: szabályozott adatok, meglévő vállalati megállapodás vagy az Ollama mögötti helyi modell.
  3. Akkor válaszd, ha a fejlesztő akarja eldönteni, mi kerüljön a kontextusba, mert ez a felelősség sosem kerül át az eszközbe.
  4. Ne válaszd, ha a feladathoz olyan ügynök kell, amely több lépésből álló munkát tervez, böngészőt vezérel vagy bővítményekkel és MCP-vel bővül.
  5. Ne válassz modellt a publikált ranglista alapján anélkül, hogy újramérnéd; a legfrissebb bejegyzések 2025 októberéből származnak.

Egy másik szempont a visszafordíthatóság. A munkafolyamat egyetlen része sem proprietáris — a fájlok, a promptok, a konfiguráció és az előzmények mind a repóban élnek —, az eszköz átvétele tehát nyom nélkül visszavonható. Ez erősebb érv, mint bármely benchmark, és nem igaz olyan ügynökre, amely egy editorban él. Aki az Aidert egy nagyobb vázba építi, a környező mintákat a kódoló ügynökök harness-tervezéséről szóló jegyzetekben találja.

Aider never enforces token limits, it only reports token limit errors from the API provider. The token counts that aider reports are estimates.

Források

  1. Aider website
  2. Aider LLM leaderboards
  3. Aider linting and testing
  4. Aider token limits
  5. Aider repository on GitHub
  6. aider-chat on PyPI

Gyakori kérdések

Ingyenes az Aider?

Maga az eszköz ingyenes: Apache-2.0, nincs fiók, nincs ülés, nincs funkcionális korlát. Az ember hoz egy API-kulcsot, és a szolgáltatónak fizet. A benchmark saját költségoszlopa szerint egy teljes, 225 feladatos futás 0,88 dollárba kerül DeepSeek chattel és 29,08 dollárba gpt-5-tel, magas reasoningszinten — ez a legkonkrétabb áradat, ami ehhez a munkához létezik.

Aider vagy Claude Code?

Az Aider akkor nyer, ha a modellválasztás, a meglévő editor és a változtatásonkénti commit feltétel; lemond a feladattervezésről, a bővítményekről és az MCP-ről. A Claude Code többet végez el felhívás nélkül, és vagy API-tokenért vagy előfizetésért fizet, a modellválasztéka szűkebb. Azok a csapatok, amelyek egyébként is minden diffet átnéznek, az elsőt részesítik előnyben, azok pedig, amelyek az eszközre bíznák a teljes feladatot, a másodikat.

Hogyan dönti el az Aider, mit lát a modell?

Minden kör három bemenetet küld ki: az előzményeket, a munkamenetbe felvett fájlokat és a kódbázis tree-sitter elemzéséből épült repótérképet. A térképet a startüzenetben kiírt token-kör korlátozza; mivel a hozzáadott fájlokat minden kör újraküldi, a gyakorlati kapcsolók a /tokens, a /drop és a /clear.

Működik helyi modellekkel az Aider?

Igen, az Ollama, az LM Studio vagy bármely OpenAI-kompatibilis végpont révén, és a helyi modellek az egyetlen út a nulla API-költségű üzemeltetéshez. Az ár a szerkesztési minőség: a gyengébb modellek gyakrabban adnak hibás szerkesztést, az Aider pedig ismeri a teljes fájl, a diff és a keretezett diff formátumait, hogy a gyengébb modell a könnyebb feladatot kapja. A projekt ranglistája nagy minőségi különbségeket mutat a modellkategóriák között ugyanazokon a feladatokon.

Pont erre van szükséged?

Írj a projektedről vagy a pozícióról – szívesen hallok felőled.