Note din rețea
Articole tehnice, decizii de infrastructură și câte un post-mortem.
Toate articolele
27 articole
AI și agențiCum dai agenților AI acces la infrastructură reală: MCP, permisiuni și rază de impactModel Context Protocol face trivial de ușor să conectezi un agent AI la baza ta de date, la clusterul tău și la monitoring. Protocolul nu te va opri să o faci periculos. Iată modelul de securitate pe care trebuie să ți-l impui singur.7 min readAI și agențiAdoptarea agenților AI de programare într-o echipă mică: un playbook practicMajoritatea sfaturilor despre adoptarea AI sunt scrise pentru enterprise-uri cu echipe de platformă și comitete de pilotare. Iată playbook-ul pentru o echipă de două până la zece persoane: ce trebuie să ai pus la punct înainte, de unde să începi, ce să măsori și la ce moduri de eșec să te aștepți în prima lună.8 min readAI și agențiCum faci review la cod scris de AI: un ghid de terenAgenții de programare AI greșesc altfel decât oamenii: codul arată bine, se citește bine și este greșit. Cum facem review la cod generat de AI după ce am livrat trei tool-uri în acest fel — ce verifici mai întâi, capcana testelor care doar seamănă a teste și un checklist practic pentru reviewer.7 min readOpen sourceTool-uri care rulează pe router: de ce construim software de infrastructură single-binary și local-firstTrei tool-uri open-source, o singură filosofie de design: control plane-ul trăiește pe server, se livrează ca un singur binar static, aplică modificările cu un auto-revert armat și îți spune sincer ce deține. Iată de ce.6 min readAI și agențiTrei tool-uri de producție în patru luni: un studiu de caz despre dezvoltarea agenticăÎntre februarie și mai am livrat trei tool-uri open-source de infrastructură — o interfață pentru firewall, o interfață pentru un router BGP și o consolă pentru Suricata — cu agenți AI de programare făcând cea mai mare parte din scris. La ce au fost buni agenții, ce a rămas la oameni și cât a costat de fapt experiența.7 min readSecuritatemeerkat: o consolă Suricata care îți arată surse, nu alerteAm făcut open source meerkat — o consolă pentru Suricata care rulează pe routerul tău, comprimă potopul de alerte într-o listă scurtă de adrese sursă și transformă fiecare adresă într-o decizie: blochezi, confirmi, pui pe allowlist sau ignori.6 min readAI și agențiAgenți AI pentru infrastructură și DevOps: ce funcționează cu adevărat în 2026Agenții AI pot scrie Terraform, pot schița runbook-uri și pot rezuma incidente — dar să lași unul să aplice schimbări în producție este modul în care transformi un typo într-un outage. Iată unde își câștigă agenții pâinea în munca de infrastructură și ce guardrail-uri îi fac siguri.7 min readRețelisticăbirdy: un UI web pentru BIRD 2.x care rulează pe routerul tăuAm făcut open source birdy — un singur binar Go care îți modelează configurația BGP într-o bază de date, generează întregul bird.conf și îl aplică cu un auto-revert armat. Plus un dashboard live cu ce face de fapt fiecare sesiune.6 min readAI și agențiWorkflow-ul nostru de dezvoltare asistată de AI: fișiere de plan, guardrail-uri și diff-uri revizuiteWorkflow-ul concret pe care îl folosim ca să livrăm software cu agenți AI de programare: un PLAN.md scris de un om, milestone-uri care nu se pot strica reciproc, CI ca poartă strictă și diff-uri mici, revizuite. Ce automatizăm, ce rămâne la oameni și ce facem când agentul o ia razna.6 min readSecuritatenftably: administrezi nftables fără teama că te încui singur afarăAm făcut open source nftably — un UI web care administrează nftables după modelul lui real de obiecte, aplică fiecare schimbare ca o singură tranzacție atomică, verificată în prealabil cu dry-run, și armează un auto-revert, ca o regulă greșită să nu te poată încuia afară de pe serverul pe care îl editezi.6 min readAI și agențiAgentic development: ce este și unde chiar funcționeazăAgenții de AI coding, definiți de o echipă care livrează cu ei: nu autocomplete, nu inginerie autonomă. Ce se schimbă în workflow — și unde eșuează.6 min readRețelisticăBGP Traffic Engineering practic: Local-Pref, Communities și PrependingTraffic engineering-ul pe outbound este o setare; pe inbound este o negociere. Cum dirijăm traficul între cele trei upstream-uri ale AS210622 — ce funcționează cu adevărat, ce funcționează abia-abia și cum măsori diferența.6 min readRețelisticăTuneluri GRE în producție: MTU, fragmentare și capcanele despre care nu te avertizează nimeniGRE are treizeci de ani și e în continuare peste tot — căi de retur pentru scrubbing, insule de rețea, protocoale de rutare peste underlay-uri ostile. Iată aritmetica MTU, blackhole-urile PMTUD și MSS clamping-ul care îl fac să funcționeze în producție.7 min readSecuritateHardening de securitate pentru Kubernetes: o listă de verificare pentru producțieInstalările implicite de Kubernetes nu sunt gata de producție. Iată lista noastră de verificare, testată în practică, pentru securizarea clusterelor — de la RBAC la network policies, pod security și protecție la runtime.4 min readRețelisticăCum construiești o rețea rezilientă: drumul nostru cu AS210622Cum am proiectat și construit sistemul nostru autonom de la zero — peering BGP, alegerea transitului și lecțiile învățate operând AS210622.3 min readDevOpsTerraform la scară: cum administrezi infrastructura multi-environment fără să-ți pierzi mințileCu Terraform e ușor să începi și greu să scalezi. Iată cum structurăm noi Terraform pentru 50+ environment-uri — gestionarea state-ului, designul modulelor, integrarea CI/CD și pattern-urile care ne țin întregi la minte.7 min readKubernetesPlatform engineering: construiește golden paths pentru developerii tăiCe este platform engineering, de ce are nevoie de el orice echipă de inginerie în creștere și cum să începi să-ți construiești Internal Developer Platform-ul.3 min readKubernetesDeploy-uri fără downtime: strategiile blue-green, canary și rolling, comparateUtilizatorii tăi n-ar trebui să știe că faci deploy. Comparăm strategiile de deploy blue-green, canary și rolling — când s-o folosești pe fiecare, cum le implementezi și compromisurile despre care nu vorbește nimeni.6 min readFiabilitateCum construiești un playbook de incident response care funcționează la 3 dimineațaIncidentele nu așteaptă programul de lucru. Iată cum structurăm noi răspunsul la incidente — de la detecție la post-mortem — astfel încât inginerul on-call de la 3 dimineața să știe exact ce are de făcut.5 min readFiabilitatePractici SRE: implementarea unor SLO-uri care chiar funcționeazăUn ghid practic pentru implementarea Service Level Objectives care echilibrează fiabilitatea cu viteza de livrare a funcționalităților. Lecții din operarea sistemelor de producție la scară.3 min readRețelisticăContainer networking în profunzime: de la perechi veth la service meshCum ajunge un pachet de la un container la altul? Urmărim traseul prin primitivele de rețea din Linux — perechi veth, bridge-uri, iptables — și cum funcționează de fapt networking-ul din Kubernetes sub capotă.7 min readKubernetesGitOps: Infrastructure as Code făcut corectGitOps înseamnă mai mult decât a ține configurările în Git. Este un model operațional complet, în care Git este singura sursă de adevăr și reconcilierea este continuă. Iată cum îl implementăm noi.5 min readBaze de dateTuning de performanță PostgreSQL pentru workload-uri de producțieSetările implicite ale PostgreSQL sunt gândite pentru un laptop. Iată cum configurăm noi Postgres pentru producție — memorie, conexiuni, vacuum, strategii de indexare și query-urile care îți omoară baza de date la 3 dimineața.7 min readFiabilitateObservabilitate dincolo de monitorizare: log-uri, metrici și trace-uri în practicăMonitorizarea îți spune că ceva este stricat. Observabilitatea îți spune de ce. Un ghid practic pentru implementarea celor trei piloni — și cum lucrează împreună pentru a reduce MTTR.5 min readSecuritateMitigarea DDoS la edge: o abordare pe straturiAtacurile volumetrice și cele la nivel de aplicație au nevoie de răspunsuri complet diferite. O trecere prin straturile de mitigare DDoS la edge — filtrare la transit, BGP Flowspec, XDP, scrubbing și L7 — și la ce e bun de fapt fiecare.7 min readFiabilitateRTO, RPO și testul de disaster recovery pe care nu-l face nimeniStabilește ținte reale de RTO și RPO — apoi dovedește-le cu runbook-uri testate și backup-uri known-good, ca recuperarea să țină când datacenter-ul principal se stinge.7 min read

















