Xử lý dữ liệu kinh tế từ GSO (National Summary Data Page)

Xử lý dữ liệu kinh tế từ GSO (National Summary Data Page)

Dành cho những ai chưa biết thì GSO gần đây đã cải tiến rất nhiều trong việc update cơ sở dữ liệu quốc gia. Hiện nay, dữ liệu của Tổng cục thống kê, Bộ tài chính và Ngân hàng nhà nước đã được thu về một mối và sử dụng cùng cấu trúc dữ liệu (National Summary Data Page). Bài viết hôm nay sẽ giúp các bạn lấy các dữ liệu đó bằng Python (machine-reading) trực tiếp từ nguồn. Rất có ích cho những người làm về data science và nghiên cứu kinh tế.

Tiếp tục đọc
Cách lấy dữ liệu từ Tổng cục thống kê (GSO) và tạo  hình động biểu đồ GDP

Cách lấy dữ liệu từ Tổng cục thống kê (GSO) và tạo hình động biểu đồ GDP

Sau một thời gian thực hành với data science, mình bắt đầu thấy thích việc đọc data online và xử lý trực tiếp qua một loạt các dòng lệnh (script) hơn là download một file .csv hay .xls về và load chúng vào chương trình. Hôm nay, mình sẽ chỉ cho các bạn một tip cực kỳ quan trọng để lấy data từ Tổng cục thống kê (GSO) về, xử lý trực tiếp trên chương trình mà không cần thiết phải save về máy, ngoài ra chúng ta sẽ nghich một chút bằng cách tạo file .gif để xem sự phát triển của nền kinh tế Việt Nam. Bài viết sẽ sử dụng Python, thư viện pandas để xử lý dữ liệu, matplotlib, imageio và numpy để vẽ biểu đồ và hình động.

Tiếp tục đọc
Cách trích xuất dữ liệu Apple Health bằng Python

Cách trích xuất dữ liệu Apple Health bằng Python

Ở bài này, chúng ta sẽ tìm cách trích xuất dữ liệu của Apple Health (bao gồm số bước chạy, quãng đường di chuyển hay thời gian ngủ). Dữ liệu của Apple Health được lưu dưới định dạng .xml nên việc lọc dữ liệu sẽ vất vả hơn so với .csv. Tuy nhiên, với Google là người bạn thân thiết thì chúng ta hoàn toàn có thể xử lý được. Cần một chút kiến thức Data Science, nhưng không có gì phức tạp lắm.

How to extract Apple Health data in Python.

Tiếp tục đọc
Cách trích xuất dữ liệu WordPress Stats bằng Python

Cách trích xuất dữ liệu WordPress Stats bằng Python

Sau một thời gian hoạt động, chắc chắn các bạn muốn biết blog của mình hoạt động ra sao. Cách đơn giản nhất để xem những dữ liệu thống kê này là vào phần /wp-admin và click vào “Site Stats”. Tuy nhiên, nếu các bạn muốn download những dữ liệu đó về máy để tự mình xử lý thì làm thế nào? Bằng một số kiến thức Python và data science cơ bản, chúng ta có thể làm được điều đó.

How to extract your own wordpress.com stats using Python.

Tiếp tục đọc