2 тысяч подписчиков
149 видео
SFBigAnalytics_20200804:Streamlit Components: Displaying complex JS and HTML components in Streamlit
SFBigAnalytics_20201110 Getting Started with Apache Spark on Kubernetes
SFBigAnalytics_20180117: Advanced Data Engineering Patterns with Apache Airflow
SFBigAnalytics_20201029 : Mastering the Industrial IoT with Apache StreamPipes
Modern Data Processing Pipelines
2015-10-20 Pinterest Chief Scientist Prof. Jure Leskovec: Discovering Networks of Products
Run Spark Applications As A Service In Large Scale On Kubernetes
NVIDIA: Accelerate Spark With RAPIDS For Cost Savings
Foundations of streaming SQL by Tyler Akidau
SFBigAnalytics_20220607: Zookeeper vs Raft: Stateful Distributed Coordination with High Availability
SFBigAnalytics_20200825: Bootstrapping meaning with embodied language learning
SFBigAnalytics: Federated Learning Application Runtime Environment for Developing Robust AI Models
SFBigAnalytics_20210601: Full Page Handwriting Recognition via Image to Sequence Extraction
SF BIg Analytics_202109_28: Beyond t-tests: Randomization, Traffic Allocation, & Multi-Armed Bandits
SFBigAnalytics_20220920: DoorDash: Building Scalable Real Time Event Processing with Kafka and Flink
SFBigAnalytics_20200116: Elastic Distributed DL Training at large scale on-prem & cloud productions
SF Big Analytics event at Baidu : Part 1 Deep Learning by Prof Andrew Ng
SFBigAnalytics_20210512: Ballista- Distributed Compute with Apache Arrow and Rust
SFBigAnalytics_2021_06_21: Delight: An Improved Apache Spark UI, Free and Cross-Platform
SFBigAnalytics_20180912:Project Hydrogen: State-of-the-Art Deep Learning on Apache Spark
SF Big Analytics20171128: Google's Neural Machine Translation System and Research progress
NVIDIA RAPIDS Accelerator for Apache Spark ML
SFBigAnalytics_20210414: Inside Apache Druid Storage and Query Engine
The Modern Data Team
SFBigAnalytics_20220707: Getting The Most From Your Data With Open Metadata
SF Big Analytics 2024-06-27: Confidential Containers for GPU Compute: Lift-and-Shift Strategy for AI
SFBigAnalytics: A Data Engineer Odyssey - The Pains Leading to Data Observability Best Practices
Declarative Reasoning with Timelines: The Next Step in Event Processing
Unlocking LLM Potential: From Federated Learning to Introspection
Fast Analytics with Presto and Alluxio
Change Stream Processing with Debezium and Apache Flink
Large-scale Data Process and ML Pipelines
Evaluation of LLMs and LLM Systems: Ensuring Relevance and Effectiveness in Real-World Applications
SFBigAnalytics_20220315: Persia: Scaling DL Based Recommenders Up To 100 Trillion Parameters
SFBigAnalytics_20200714: Productionalizing Big Data (talks from Lyft and Workday)
SFBigAnaytics_20210414 Project Nessie: A git-like experience for Data Lakes
SFBigAnalytics_20200908: Magnet Shuffle Service: Push-based Shuffle at LinkedIn
Fraud Detection with Graph Features and Graph Neural Networks
Time Series Data and Stream Processing Performance Tuning
Python Streaming Pipelines with Beam on Flink
GraphHouse and Training GNNs at Internet Scale
SF Big Analytics_20220505: How can StarRocks outperform ClickHouse, Apache Druid and Trino
Data Lake to Dashboard
NVIDIA: Federated XGBoost - Formulation to Implementation
Federated Learning: from simulation to production, cross-device and cross-silo