Tagged articles

performance monitoring

453 articles · Page 5 of 5
360 Zhihui Cloud Developer
360 Zhihui Cloud Developer
Jan 25, 2018 · Operations

Master Elasticsearch Monitoring: Key System, Cluster, and Resource Metrics Explained

This article expands on Elasticsearch performance monitoring by detailing host‑level system and network metrics, cluster health and node availability, resource saturation, thread‑pool behavior, cache usage, and common error indicators, offering practical guidance for maintaining a stable and efficient search cluster.

Elasticsearchcluster-healthperformance monitoring
0 likes · 15 min read
Master Elasticsearch Monitoring: Key System, Cluster, and Resource Metrics Explained
DevOpsClub
DevOpsClub
Dec 26, 2017 · Operations

15 Essential DevOps Metrics Every Team Should Track

This article outlines fifteen key DevOps metrics—ranging from deployment frequency and lead time to MTTR and availability—that help organizations assess and improve their continuous delivery speed, quality, and overall system performance over time.

DevOpsperformance monitoring
0 likes · 11 min read
15 Essential DevOps Metrics Every Team Should Track
Architecture Digest
Architecture Digest
Dec 23, 2017 · Cloud Computing

Design and Practices of an Elastic Computing Platform for Efficient Resource Utilization

This article describes the design, challenges, and operational practices of a cloud‑native elastic computing platform that reuses idle resources from production servers to support massive image compression, video transcoding, AI inference, and log processing while ensuring online services maintain performance, latency, and reliability.

Cloud InfrastructureContainer OrchestrationOOM handling
0 likes · 13 min read
Design and Practices of an Elastic Computing Platform for Efficient Resource Utilization
Qizhuo Club
Qizhuo Club
Dec 15, 2017 · Mobile Development

How 360 Mobile Guard Optimizes App Performance with Its Own Monitoring System

This article explains how 360 Mobile Guard, a massive Android security app built on the RePlugin framework, implements a comprehensive performance monitoring system—including offline code checks, Argus APM tools, online crash and metric collection, diagnostic plugins, and future AI-driven analysis—to identify and resolve performance issues and improve user experience.

APMAndroidApp Optimization
0 likes · 9 min read
How 360 Mobile Guard Optimizes App Performance with Its Own Monitoring System
Dada Group Technology
Dada Group Technology
Dec 8, 2017 · Backend Development

Key Considerations for Large‑Scale System Refactoring: Lessons from Dada JD.com’s Double‑11 Experience

The article shares practical insights on planning, designing, developing, testing, and rolling out a large‑scale backend system refactor, emphasizing resource limits, pain points of legacy code, unit‑test protection, layering, decoupling, monitoring, and staged deployment to ensure stability during high‑traffic events.

Backend ArchitectureDecouplinggradual rollout
0 likes · 9 min read
Key Considerations for Large‑Scale System Refactoring: Lessons from Dada JD.com’s Double‑11 Experience
JD Retail Technology
JD Retail Technology
Dec 5, 2017 · Mobile Development

Implementation of a Main Thread Lag Collection SDK for Android

This article describes the design and implementation of a non‑intrusive Android SDK that monitors main‑thread UI lag by replacing the Looper printer, sampling stack traces, aggregating data on the server, and automatically generating work orders for precise performance optimization.

AndroidSDKUI Thread
0 likes · 10 min read
Implementation of a Main Thread Lag Collection SDK for Android
Suning Technology
Suning Technology
Nov 11, 2017 · Operations

Zero-Accident O2O Festival: Suning’s Frontend, App & Network Ops Secrets

Suning’s 2017 O2O shopping festival achieved a “zero‑incident” goal by integrating real‑time browser performance monitoring, WEEX‑based WAP acceleration, comprehensive app data collection with cloud‑based analytics, precise DNS and HTTP2 optimizations, and a multi‑layer network and service monitoring system that enabled rapid fault detection and capacity planning.

App OperationsNetwork ReliabilityO2O
0 likes · 15 min read
Zero-Accident O2O Festival: Suning’s Frontend, App & Network Ops Secrets
21CTO
21CTO
Nov 2, 2017 · Operations

How to Diagnose and Fix Online System Issues Efficiently

This article shares practical methods for frontline engineers to quickly understand, assess, and resolve online system problems by categorizing system layers, evaluating impact, using essential Linux monitoring tools, and applying systematic troubleshooting and design‑for‑failure strategies to minimize downtime.

Linux toolsOnline Debuggingbackend operations
0 likes · 11 min read
How to Diagnose and Fix Online System Issues Efficiently
Architecture Digest
Architecture Digest
Nov 1, 2017 · Operations

A Structured Approach to Online System Issue Diagnosis and Recovery

This article outlines a systematic methodology for understanding, evaluating, and quickly resolving production system incidents by categorizing system layers, assessing impact, employing Linux diagnostic tools, and designing fault‑tolerant mechanisms to minimize downtime and maintain core functionality.

Incident ManagementLinux toolsOperations
0 likes · 12 min read
A Structured Approach to Online System Issue Diagnosis and Recovery
Java Captain
Java Captain
Oct 27, 2017 · Information Security

Practical Tips for Securing and Optimizing Java APIs

This article presents a collection of straightforward, developer‑friendly techniques for enhancing Java API security and performance, covering API key protection, TLS adoption, Spring Boot web service creation, application monitoring, and safeguarding sensitive configuration files.

API securityTLSperformance monitoring
0 likes · 8 min read
Practical Tips for Securing and Optimizing Java APIs
High Availability Architecture
High Availability Architecture
Sep 22, 2017 · Databases

LinkedIn's Network‑Level MySQL Query Analyzer: Architecture, Implementation, and Performance Evaluation

This article describes LinkedIn's network‑level MySQL query analyzer, explaining why it was needed, its three‑component architecture (agent, central server, UI), fingerprinting and hash‑map techniques, performance benchmarks, metric collection, security considerations, and the benefits it brings to database operations.

MySQLQuery Analyzerdatabase optimization
0 likes · 13 min read
LinkedIn's Network‑Level MySQL Query Analyzer: Architecture, Implementation, and Performance Evaluation
dbaplus Community
dbaplus Community
Aug 15, 2017 · Operations

How One‑Click Thread Analysis Transforms Automated APM in Microservice Ops

This article explains the role of APM in automated operations, outlines the challenges of manual thread diagnostics, and presents a one‑click thread analysis solution with a five‑stage architecture—capture, aggregation, storage, query, and deep analysis—illustrated through multiple real‑world scenarios.

APMAutomated OperationsThread analysis
0 likes · 25 min read
How One‑Click Thread Analysis Transforms Automated APM in Microservice Ops
Baidu Waimai Technology Team
Baidu Waimai Technology Team
Jul 4, 2017 · Operations

Building a Full‑Stack Operations Monitoring System: Strategies, Implementation & Lessons

This article details the end‑to‑end process of designing and deploying an operations‑focused monitoring framework, covering semantic, log, and performance monitoring, protobuf integration, implementation challenges, actual effects, and future optimization directions for large‑scale online services.

Log MonitoringProtobufad-hoc queries
0 likes · 13 min read
Building a Full‑Stack Operations Monitoring System: Strategies, Implementation & Lessons
Hujiang Technology
Hujiang Technology
Jun 23, 2017 · Mobile Development

Implementing iOS Performance Monitoring: CPU, Memory, FPS, Startup Time, and Power Consumption

This article details the design and implementation of an iOS performance‑monitoring SDK that captures fundamental metrics such as CPU usage, memory consumption, frame rate, cold and hot startup times, and power draw, explains the underlying Mach APIs, provides sample Objective‑C code, and discusses practical considerations for accurate measurement and troubleshooting.

CPU usageMemory usagePower Consumption
0 likes · 26 min read
Implementing iOS Performance Monitoring: CPU, Memory, FPS, Startup Time, and Power Consumption
Efficient Ops
Efficient Ops
Jun 18, 2017 · Operations

Choosing the Right Bypass Monitoring Tool: Balancing Cost, Performance, and Value

The article examines the challenges of selecting hardware and monitoring tools, comparing Intel CPUs on performance versus price, and outlines criteria for evaluating bypass‑monitoring products, emphasizing cost, reliability, scalability, and data‑decoding capabilities to guide informed operational decisions.

Cost-Benefit AnalysisOperationsnetwork bypass
0 likes · 9 min read
Choosing the Right Bypass Monitoring Tool: Balancing Cost, Performance, and Value
ITPUB
ITPUB
Jun 18, 2017 · Operations

Master Linux Performance: Essential Monitoring Tools and Practical Usage

This article provides a comprehensive guide to Linux performance analysis, covering background concepts, detailed explanations of tools such as vmstat, iostat, dstat, iotop, pidstat, top/htop, mpstat, netstat, ps, strace, lsof, perf, and sar, along with practical command examples and usage tips.

dstatiostatperf
0 likes · 16 min read
Master Linux Performance: Essential Monitoring Tools and Practical Usage
ITPUB
ITPUB
Apr 13, 2017 · Operations

Essential Linux Performance Monitoring Tools Every Sysadmin Should Know

This article introduces core Linux performance monitoring utilities—top, vmstat, pidstat, iostat, netstat, sar, tcpdump, and others—explaining their output fields, typical usage scenarios, and how to interpret metrics to diagnose CPU, memory, disk, and network bottlenecks on servers.

performance monitoringsystem administrationtools
0 likes · 16 min read
Essential Linux Performance Monitoring Tools Every Sysadmin Should Know
dbaplus Community
dbaplus Community
Dec 29, 2016 · Databases

How a Veteran DBA Built the DPM Database Performance Analysis Platform

This article recaps a DBAplus community session where a seasoned DBA shares common operational scenarios, diagnostic techniques, lock‑handling strategies, and step‑by‑step SQL optimization methods, while unveiling the DPM platform that automates inspection, data collection, and performance analysis for Oracle databases.

DBADPMDatabase Performance
0 likes · 22 min read
How a Veteran DBA Built the DPM Database Performance Analysis Platform
ITFLY8 Architecture Home
ITFLY8 Architecture Home
Dec 1, 2016 · Operations

Why Distributed Tracing Systems Are Essential for Modern Microservices

As microservice architectures grow, service calls become increasingly complex, involving dozens of services and teams, making rapid fault localization and comprehensive data analysis critical; distributed tracing systems address these challenges by providing end‑to‑end visibility, low‑overhead instrumentation, and scalable monitoring across large‑scale applications.

Fault LocalizationSystem Designdistributed tracing
0 likes · 8 min read
Why Distributed Tracing Systems Are Essential for Modern Microservices
Architecture Digest
Architecture Digest
Oct 25, 2016 · Backend Development

MTrace: Meituan‑Dianping Distributed Session Tracing System Design and Practice

The article introduces MTrace, Meituan‑Dianping’s large‑scale distributed session tracing system, explaining its call‑chain concept, architecture, data‑embedding SDK, trace and span identifiers, APIs for transparent data propagation, and how it enables bottleneck detection, performance optimization, and comprehensive monitoring across heterogeneous backend services.

Service Governancebackend observabilitydistributed tracing
0 likes · 11 min read
MTrace: Meituan‑Dianping Distributed Session Tracing System Design and Practice
dbaplus Community
dbaplus Community
Oct 18, 2016 · Databases

Mastering Oracle AWR: How to Decode and Optimize Database Performance

This comprehensive guide explains Oracle's Automatic Workload Repository (AWR), how snapshots are collected and retained, and provides step‑by‑step instructions for interpreting the most common AWR report sections, from cache sizes and load profiles to SQL statistics and RAC metrics, helping DBAs pinpoint bottlenecks and improve performance.

AWRDatabase PerformanceOracle
0 likes · 32 min read
Mastering Oracle AWR: How to Decode and Optimize Database Performance
Qunar Tech Salon
Qunar Tech Salon
Sep 18, 2016 · Operations

Analyzing Nginx Access Logs for Traffic, Performance, and Optimization

This article explains how to extract valuable performance and traffic insights from Nginx access logs using shell commands and awk, covering request volume, peak rates, bandwidth usage, slow‑query detection, URL normalization, and practical optimization recommendations for web operations.

OperationsShell scriptingawk
0 likes · 13 min read
Analyzing Nginx Access Logs for Traffic, Performance, and Optimization
Baidu Intelligent Testing
Baidu Intelligent Testing
Aug 23, 2016 · Mobile Development

SmartMonkey: Android System‑Level Stability Testing Tool – Introduction, Features, and Usage Guide

This article introduces Baidu's SmartMonkey, an Android system‑level stability testing tool built on Robotium, outlines its key features such as accurate page interaction, configurable critical paths, performance data collection, and provides step‑by‑step instructions for project setup, configuration, test execution, and report analysis.

AndroidRobotiumSmartMonkey
0 likes · 8 min read
SmartMonkey: Android System‑Level Stability Testing Tool – Introduction, Features, and Usage Guide
Qunar Tech Salon
Qunar Tech Salon
Jun 12, 2016 · Operations

18 Command‑Line Tools to Monitor Linux Performance

This article presents a curated list of 18 lesser‑known command‑line utilities for Linux/Unix administrators, explaining their purpose, typical usage scenarios, and how they help monitor system resources, network activity, and security events.

LinuxOperationscommand-line tools
0 likes · 11 min read
18 Command‑Line Tools to Monitor Linux Performance
Efficient Ops
Efficient Ops
May 26, 2016 · Operations

12 Essential Linux Command-Line Tools for Performance Monitoring

This article presents a curated list of twelve powerful command-line utilities—such as lsof, htop, iotop, IPTraf, Monit, netHogs, iftop, and Monitorix—that Linux system administrators can use to monitor, diagnose, and optimize system and network performance.

LinuxOperationscommand-line tools
0 likes · 9 min read
12 Essential Linux Command-Line Tools for Performance Monitoring
ITPUB
ITPUB
Apr 8, 2016 · Databases

How to Monitor and Analyze Oracle SQL Statements with Powerful Queries

This guide provides Oracle SQL queries to list currently running statements, retrieve historical SQL, identify high‑CPU or high‑disk‑usage queries, find slow statements, and detect uncommitted transactions, enabling DBAs to quickly diagnose performance issues.

Database AdministrationOracleQueries
0 likes · 4 min read
How to Monitor and Analyze Oracle SQL Statements with Powerful Queries
dbaplus Community
dbaplus Community
Feb 15, 2016 · Databases

How to Diagnose and Report MySQL/Oracle Issues Within 10 Minutes

This guide walks through a rapid 10‑minute troubleshooting workflow for MySQL and Oracle databases, covering resource checks, log inspection, wait‑event analysis, SQL identification, and feedback best practices to quickly pinpoint performance problems without relying on external monitoring tools.

Database TroubleshootingMySQLOracle
0 likes · 9 min read
How to Diagnose and Report MySQL/Oracle Issues Within 10 Minutes
dbaplus Community
dbaplus Community
Jan 13, 2016 · Databases

Simplify Oracle DBA Tasks with the OraZ Automation Toolkit

This article explains how the OraZ toolset streamlines Oracle database administration by automating routine tasks, providing intelligent hang analysis, offering comprehensive health checks, and delivering real‑time instance activity insights, ultimately reducing DBA workload and improving operational efficiency.

AutomationDBAHang Analysis
0 likes · 15 min read
Simplify Oracle DBA Tasks with the OraZ Automation Toolkit
21CTO
21CTO
Dec 30, 2015 · Frontend Development

How Meituan Overcame Performance Bottlenecks with a Custom Analysis Framework

This article details Meituan's 2014 presentation on building a performance analysis framework and monitoring platform, describing the bottlenecks they faced, the metrics they collected, the insights gained, and the tangible improvements achieved across front‑end and back‑end processing.

Frontend OptimizationMeituanWeb Performance
0 likes · 13 min read
How Meituan Overcame Performance Bottlenecks with a Custom Analysis Framework
dbaplus Community
dbaplus Community
Dec 4, 2015 · Big Data

Big Data Insights from the 2015 Internet+ Summit: Advertising, Finance & Security

The article compiles detailed notes from the 2015 Internet+ Big Data Summit, highlighting how data monetization reshapes advertising, drives financial analytics, improves operational efficiency, and strengthens security, while presenting real‑world case studies, models, and practical recommendations from industry experts.

AdvertisingData GovernanceData Monetization
0 likes · 17 min read
Big Data Insights from the 2015 Internet+ Summit: Advertising, Finance & Security
dbaplus Community
dbaplus Community
Oct 28, 2015 · Databases

Expert DBA Answers: Career Paths, Storage Performance, and Monitoring Strategies

Senior DBA and architect Bai Shan answers community questions on advancing from DBA to architect, future career routes, testing environment setup, interpreting AWR storage metrics, using sar and iostat for disk I/O monitoring, cache sizing, and the growing importance of automation in cloud-era database operations.

AutomationDatabase Administrationcareer development
0 likes · 7 min read
Expert DBA Answers: Career Paths, Storage Performance, and Monitoring Strategies
dbaplus Community
dbaplus Community
Oct 17, 2015 · Databases

Master PostgreSQL: From Origins to Hands‑On Labs and HA Strategies

This article presents a comprehensive overview of PostgreSQL, covering its history, architecture, core features, step‑by‑step lab exercises for database creation, CRUD operations, configuration tuning, performance monitoring, backup and recovery, Hot Standby replication, PGPOOL clustering, and a curated Q&A session addressing common DBA challenges.

BackupHAPostgreSQL
0 likes · 19 min read
Master PostgreSQL: From Origins to Hands‑On Labs and HA Strategies
MaGe Linux Operations
MaGe Linux Operations
Oct 12, 2015 · Operations

How to Identify and Eliminate Linux System Performance Bottlenecks

These notes distill key insights from the book “Linux System and Performance Monitoring,” outlining how to pinpoint and remove system bottlenecks across CPU, memory, I/O, and network, classify application types, establish baselines, and leverage common monitoring tools for effective Linux performance tuning.

Linuxbottleneck analysisperformance monitoring
0 likes · 3 min read
How to Identify and Eliminate Linux System Performance Bottlenecks
MaGe Linux Operations
MaGe Linux Operations
Nov 3, 2014 · Operations

How to Detect and Fix CPU Bottlenecks on Linux Servers

This article explains why high CPU usage on Linux servers isn’t always a problem, describes how to identify true CPU bottlenecks using tools like uptime, top, sar and vmstat, and offers practical tuning steps such as stopping unnecessary processes, adjusting priorities, using CPU affinity, and updating drivers.

CPU bottleneckLinuxSMP
0 likes · 5 min read
How to Detect and Fix CPU Bottlenecks on Linux Servers