use crate::DbPool; use crate::api::ClientVersion; use crate::providers::{ Provider, report_provider_error, report_provider_error_background, requester_or_default, }; use crate::uploaders::{ UploaderChannelStat, UploaderLayoutRow, UploaderProfile, UploaderVideoRef, iso_timestamp_from_unix, }; use crate::util::cache::VideoCache; use crate::util::parse_abbreviated_number; use crate::util::time::parse_time_to_seconds; use crate::videos::{ServerOptions, VideoItem}; use crate::{status::*, util}; use async_trait::async_trait; use error_chain::error_chain; use htmlentity::entity::{ICodedDataTrait, decode}; use percent_encoding::{NON_ALPHANUMERIC, percent_decode_str, utf8_percent_encode}; use regex::Regex; use scraper::{Html, Selector}; use std::sync::{Arc, RwLock}; use std::thread; use std::vec; pub const CHANNEL_METADATA: crate::providers::ProviderChannelMetadata = crate::providers::ProviderChannelMetadata { group_id: "studio-network", tags: &["studio", "networks", "models"], }; error_chain! { foreign_links { Io(std::io::Error); HttpRequest(wreq::Error); } } #[derive(Debug, Clone)] pub struct OmgxxxProvider { url: String, sites: Arc>>, networks: Arc>>, stars: Arc>>, } #[derive(Debug, Clone, PartialEq, Eq)] enum OmgUploaderTargetKind { Site, Network, } #[derive(Debug, Clone)] struct OmgUploaderTarget { kind: OmgUploaderTargetKind, id: String, title: String, } impl OmgxxxProvider { pub fn new() -> Self { let provider = OmgxxxProvider { url: "https://www.omg.xxx".to_string(), sites: Arc::new(RwLock::new(vec![FilterOption { id: "all".to_string(), title: "All".to_string(), }])), networks: Arc::new(RwLock::new(vec![FilterOption { id: "all".to_string(), title: "All".to_string(), }])), stars: Arc::new(RwLock::new(vec![FilterOption { id: "all".to_string(), title: "All".to_string(), }])), }; // Kick off the background load but return immediately provider.spawn_initial_load(); provider } fn spawn_initial_load(&self) { let url = self.url.clone(); let sites = Arc::clone(&self.sites); let networks = Arc::clone(&self.networks); let stars = Arc::clone(&self.stars); thread::spawn(move || { // Create a tiny runtime just for these async tasks let rt = match tokio::runtime::Builder::new_current_thread() .enable_all() .build() { Ok(rt) => rt, Err(e) => { report_provider_error_background( "omgxxx", "spawn_initial_load.runtime_build", &e.to_string(), ); return; } }; rt.block_on(async move { // If you have a streaming sites loader, call it here too if let Err(e) = Self::load_sites(&url, sites).await { eprintln!("load_sites_into failed: {e}"); } if let Err(e) = Self::load_networks(&url, networks).await { eprintln!("load_networks failed: {e}"); } if let Err(e) = Self::load_stars(&url, stars).await { eprintln!("load_stars failed: {e}"); } }); }); } async fn load_stars(base_url: &str, stars: Arc>>) -> Result<()> { let mut requester = util::requester::Requester::new(); for page in [1..10].into_iter().flatten() { let text = match requester .get( format!("{}/models/total-videos/{}/?gender_id=0", &base_url, page).as_str(), None, ) .await { Ok(text) => text, Err(e) => { report_provider_error_background( "omgxxx", "load_stars.request", &format!("url={base_url}; page={page}; error={e}"), ); break; } }; if text.contains("404 Not Found") || text.is_empty() { break; } let stars_div = text .split("
") .collect::>() .last() .copied() .unwrap_or_default() .split("custom_list_models_models_list_pagination") .collect::>() .get(0) .copied() .unwrap_or_default(); for stars_element in stars_div.split(">()[1..].to_vec() { let star_url = stars_element .split("href=\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("\"") .collect::>() .get(0) .copied() .unwrap_or_default(); let star_id = star_url .split("/") .collect::>() .get(4) .copied() .unwrap_or_default() .to_string(); let star_name = stars_element .split("") .collect::>() .get(1) .copied() .unwrap_or_default() .split("<") .collect::>() .get(0) .copied() .unwrap_or_default() .to_string(); Self::push_unique( &stars, FilterOption { id: star_id, title: star_name, }, ); } } return Ok(()); } async fn load_sites(base_url: &str, sites: Arc>>) -> Result<()> { let mut requester = util::requester::Requester::new(); let mut page = 0; loop { page += 1; let text = requester .get(format!("{}/sites/{}/", &base_url, page).as_str(), None) .await; let text = match text { Ok(text) => text, Err(e) => { report_provider_error_background( "omgxxx", "load_sites.request", &format!("url={base_url}; page={page}; error={e}"), ); break; } }; if text.contains("404 Not Found") || text.is_empty() { break; } let sites_div = text .split("id=\"list_content_sources_sponsors_list_items\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("class=\"pagination\"") .collect::>() .get(0) .copied() .unwrap_or_default(); for sites_element in sites_div.split("class=\"headline\"").collect::>()[1..].to_vec() { let site_url = sites_element .split("href=\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("\"") .collect::>() .get(0) .copied() .unwrap_or_default(); let site_id = site_url .split("/") .collect::>() .get(4) .copied() .unwrap_or_default() .to_string(); let site_name = sites_element .split("

") .collect::>() .get(1) .copied() .unwrap_or_default() .split("<") .collect::>() .get(0) .copied() .unwrap_or_default() .to_string(); Self::push_unique( &sites, FilterOption { id: site_id, title: site_name, }, ); } } return Ok(()); } async fn load_networks(base_url: &str, networks: Arc>>) -> Result<()> { let mut requester = util::requester::Requester::new(); let text = match requester.get(&base_url, None).await { Ok(text) => text, Err(e) => { report_provider_error_background( "omgxxx", "load_networks.request", &format!("url={base_url}; error={e}"), ); return Ok(()); } }; let networks_div = text .split("class=\"sites__list\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("

") .collect::>() .get(0) .copied() .unwrap_or_default(); for network_element in networks_div.split("sites__item").collect::>()[1..].to_vec() { if network_element.contains("sites__all") { continue; } let network_url = network_element .split("href=\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("\"") .collect::>() .get(0) .copied() .unwrap_or_default(); let network_id = network_url .split("/") .collect::>() .get(4) .copied() .unwrap_or_default() .to_string(); let network_name = network_element .split(">") .collect::>() .get(1) .copied() .unwrap_or_default() .split("<") .collect::>() .get(0) .copied() .unwrap_or_default() .to_string(); Self::push_unique( &networks, FilterOption { id: network_id, title: network_name, }, ); } return Ok(()); } // Push one item with minimal lock time and dedup by id fn push_unique(target: &Arc>>, item: FilterOption) { if let Ok(mut vec) = target.write() { if !vec.iter().any(|x| x.id == item.id) { vec.push(item); // Optional: keep it sorted for nicer UX // vec.sort_by(|a,b| a.title.cmp(&b.title)); } } } fn build_channel(&self, clientversion: ClientVersion) -> Channel { let _ = clientversion; let sites: Vec = self .sites .read() .map(|g| g.clone()) // or: .map(|g| g.to_vec()) .unwrap_or_default(); // or: .unwrap_or_else(|_| Vec::new()) let networks: Vec = self .networks .read() .map(|g| g.clone()) // or: .map(|g| g.to_vec()) .unwrap_or_default(); // or: .unwrap_or_else(|_| Vec::new()) let stars: Vec = self .stars .read() .map(|g| g.clone()) // or: .map(|g| g.to_vec()) .unwrap_or_default(); // or: .unwrap_or_else(|_| Vec::new()) Channel { id: "omgxxx".to_string(), name: "OMG XXX".to_string(), description: "OMG look at that Collection!".to_string(), premium: false, favicon: "https://www.google.com/s2/favicons?sz=64&domain=www.omg.xxx".to_string(), status: "active".to_string(), categories: vec![], options: vec![ ChannelOption { id: "sort".to_string(), title: "Sort".to_string(), description: "Sort the Videos".to_string(), systemImage: "list.number".to_string(), colorName: "blue".to_string(), options: vec![ FilterOption { id: "latest-updates".into(), title: "Latest".into(), }, FilterOption { id: "most-popular".into(), title: "Most Viewed".into(), }, FilterOption { id: "top-rated".into(), title: "Top Rated".into(), }, ], multiSelect: false, }, ChannelOption { id: "sites".to_string(), title: "Sites".to_string(), description: "Filter for different Sites".to_string(), systemImage: "rectangle.stack".to_string(), colorName: "green".to_string(), options: sites, multiSelect: false, }, ChannelOption { id: "networks".to_string(), title: "Networks".to_string(), description: "Filter for different Networks".to_string(), systemImage: "list.dash".to_string(), colorName: "purple".to_string(), options: networks, multiSelect: false, }, ChannelOption { id: "stars".to_string(), title: "Stars".to_string(), description: "Filter for different Pornstars".to_string(), systemImage: "star.fill".to_string(), colorName: "yellow".to_string(), options: stars, multiSelect: false, }, ], nsfw: true, cacheDuration: None, } } fn canonical_uploader_id(kind: &OmgUploaderTargetKind, id: &str) -> String { let kind = match kind { OmgUploaderTargetKind::Site => "site", OmgUploaderTargetKind::Network => "network", }; format!( "omgxxx:{kind}:{}", utf8_percent_encode(id, NON_ALPHANUMERIC) ) } fn uploader_target_from_id(&self, uploader_id: &str) -> Option { let parts = uploader_id.split(':').collect::>(); if parts.is_empty() { return None; } let (kind, raw_id) = match parts.as_slice() { ["omgxxx", kind, raw_id] => (*kind, *raw_id), ["omgxxx", raw_id] => ("site", *raw_id), _ => return None, }; let decoded_id = percent_decode_str(raw_id).decode_utf8().ok()?.to_string(); match kind { "site" => self .sites .read() .ok()? .iter() .find(|option| option.id == decoded_id) .map(|option| OmgUploaderTarget { kind: OmgUploaderTargetKind::Site, id: option.id.clone(), title: option.title.clone(), }) .or_else(|| { Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Site, id: decoded_id.clone(), title: decoded_id.clone(), }) }), "network" => self .networks .read() .ok()? .iter() .find(|option| option.id == decoded_id) .map(|option| OmgUploaderTarget { kind: OmgUploaderTargetKind::Network, id: option.id.clone(), title: option.title.clone(), }) .or_else(|| { Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Network, id: decoded_id.clone(), title: decoded_id.clone(), }) }), _ => None, } } fn uploader_target_from_name(&self, uploader_name: &str) -> Option { let normalized = uploader_name.trim(); if normalized.is_empty() { return None; } let lowered = normalized.to_ascii_lowercase(); if let Ok(sites) = self.sites.read() { if let Some(option) = sites.iter().find(|option| { option.title.eq_ignore_ascii_case(normalized) || option.id.eq_ignore_ascii_case(normalized) || option.title.to_ascii_lowercase() == lowered }) { return Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Site, id: option.id.clone(), title: option.title.clone(), }); } } if let Ok(networks) = self.networks.read() { if let Some(option) = networks.iter().find(|option| { option.title.eq_ignore_ascii_case(normalized) || option.id.eq_ignore_ascii_case(normalized) || option.title.to_ascii_lowercase() == lowered }) { return Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Network, id: option.id.clone(), title: option.title.clone(), }); } } None } fn resolve_uploader_target( &self, uploader_id: Option<&str>, uploader_name: Option<&str>, ) -> Option { uploader_id .and_then(|value| self.uploader_target_from_id(value)) .or_else(|| uploader_name.and_then(|value| self.uploader_target_from_name(value))) } fn uploader_target_url(&self, target: &OmgUploaderTarget, page: u8) -> String { let base = match target.kind { OmgUploaderTargetKind::Site => "sites", OmgUploaderTargetKind::Network => "networks", }; format!("{}/{}/{}/{}/", self.url, base, target.id, page.max(1)) } fn uploader_target_last_page(&self, html: &str, target: &OmgUploaderTarget) -> Option { let base = match target.kind { OmgUploaderTargetKind::Site => "sites", OmgUploaderTargetKind::Network => "networks", }; let pattern = format!(r#"/{}/{}/(?P\d+)/"#, regex::escape(base), regex::escape(&target.id)); let regex = Regex::new(&pattern).ok()?; regex .captures_iter(html) .filter_map(|captures| captures.name("page")?.as_str().parse::().ok()) .max() } fn display_name_for_uploader_target( &self, target: &OmgUploaderTarget, html: &str, first_page_items: &[VideoItem], ) -> String { if !target.title.trim().is_empty() && target.title != target.id { return target.title.clone(); } if let Some(title) = html .split("") .nth(1) .and_then(|segment| segment.split("").next()) .map(|title| decode(title.as_bytes()).to_string().unwrap_or_else(|_| title.to_string())) .map(|title| title.replace(" Porn! 😮 - OMG.XXX", "")) .map(|title| title.replace(" - OMG.XXX", "")) .map(|title| title.trim().to_string()) .filter(|title| !title.is_empty()) { return title; } if let Some(site_name) = first_page_items.iter().find_map(|item| { item.title .strip_prefix('[') .and_then(|title| title.split(']').next()) .map(str::trim) .filter(|value| !value.is_empty()) .map(ToOwned::to_owned) }) { return site_name; } target .id .split('-') .map(|part| { let mut chars = part.chars(); match chars.next() { Some(first) => first.to_uppercase().collect::() + chars.as_str(), None => String::new(), } }) .collect::>() .join(" ") } fn rank_uploader_videos( videos: &[UploaderVideoRef], query: Option<&str>, ) -> Vec { let Some(query) = query.map(str::trim).filter(|value| !value.is_empty()) else { return videos.to_vec(); }; let query = query.to_ascii_lowercase(); let mut ranked = videos.to_vec(); ranked.sort_by(|a, b| { let score = |video: &UploaderVideoRef| { let mut score = 0u8; if video.title.to_ascii_lowercase().contains(&query) { score += 2; } if video.uploader.to_ascii_lowercase().contains(&query) { score += 1; } score }; score(b) .cmp(&score(a)) .then(b.views.cmp(&a.views)) .then_with(|| a.id.cmp(&b.id)) }); ranked } fn uploader_target_from_href_and_title(&self, href: &str, title: &str) -> Option { if href.contains("/sites/") { let id = href .split("/sites/") .nth(1) .unwrap_or_default() .split('/') .next() .unwrap_or_default() .to_string(); if id.is_empty() { return None; } return Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Site, id, title: title.to_string(), }); } if href.contains("/networks/") { let id = href .split("/networks/") .nth(1) .unwrap_or_default() .split('/') .next() .unwrap_or_default() .to_string(); if id.is_empty() { return None; } return Some(OmgUploaderTarget { kind: OmgUploaderTargetKind::Network, id, title: title.to_string(), }); } None } async fn build_uploader_profile( &self, _cache: VideoCache, target: &OmgUploaderTarget, query: Option<&str>, profile_content: bool, options: &ServerOptions, ) -> Result> { let first_page_url = self.uploader_target_url(target, 1); let mut requester = requester_or_default(options, module_path!(), "missing_requester"); let first_page_html = match requester.get(&first_page_url, None).await { Ok(html) => html, Err(error) => { return Err(Error::from(format!( "uploader page request failed url={first_page_url}; error={error}" ))); } }; let first_page_items = self.get_video_items_from_html(first_page_html.clone()); if first_page_items.is_empty() { return Ok(None); } let display_name = self.display_name_for_uploader_target(target, &first_page_html, &first_page_items); let last_page = self .uploader_target_last_page(&first_page_html, target) .unwrap_or(1); let last_page_items = if last_page > 1 { let mut requester = requester_or_default(options, module_path!(), "missing_requester"); let html = requester .get(&self.uploader_target_url(target, last_page), None) .await .unwrap_or_default(); self.get_video_items_from_html(html) } else { Vec::new() }; let uploader_id = Self::canonical_uploader_id(&target.kind, &target.id); let mut video_refs = first_page_items .iter() .map(|item| { let mut video = UploaderVideoRef::from_video_item(item, &display_name, &uploader_id); video.uploader = display_name.clone(); video.uploaderId = uploader_id.clone(); video }) .collect::>(); let ranked = Self::rank_uploader_videos(&video_refs, query); let featured_ids = ranked .iter() .take(12) .map(|video| video.id.clone()) .collect::>(); let video_count = if last_page > 1 { ((last_page as u64 - 1) * first_page_items.len() as u64) + last_page_items.len() as u64 } else { first_page_items.len() as u64 }; let total_views = first_page_items .iter() .chain(last_page_items.iter()) .filter_map(|item| item.views) .map(u64::from) .sum(); let newest = first_page_items.iter().filter_map(|item| item.uploadedAt).max(); let oldest = last_page_items .iter() .filter_map(|item| item.uploadedAt) .min() .or_else(|| first_page_items.iter().filter_map(|item| item.uploadedAt).min()); for video in &mut video_refs { video.uploader = display_name.clone(); video.uploaderId = uploader_id.clone(); } let layout = if featured_ids.is_empty() { vec![UploaderLayoutRow::videos(None)] } else { vec![ UploaderLayoutRow::horizontal(Some("For You".to_string()), featured_ids), UploaderLayoutRow::videos(None), ] }; Ok(Some(UploaderProfile { id: uploader_id, name: display_name, url: Some(first_page_url), channel: Some("omgxxx".to_string()), verified: false, videoCount: video_count, totalViews: total_views, channels: Some(vec![UploaderChannelStat { channel: "omgxxx".to_string(), videoCount: video_count, firstSeenAt: iso_timestamp_from_unix(oldest), lastSeenAt: iso_timestamp_from_unix(newest), }]), avatar: None, description: None, bio: None, videos: profile_content.then_some(video_refs), tapes: profile_content.then_some(Vec::new()), playlists: profile_content.then_some(Vec::new()), layout: Some(layout), })) } async fn get( &self, cache: VideoCache, page: u8, sort: &str, options: ServerOptions, ) -> Result> { let mut sort_string: String = match sort { "top-rated" => "top-rated".to_string(), "most-popular" => "most-popular".to_string(), _ => "latest-updates".to_string(), }; let alt_sort_string: String = match sort { "top-rated" => "/top-rated".to_string(), "most-popular" => "/most-popular".to_string(), _ => "".to_string(), }; if let Some(network) = options.network.as_deref() { if !network.is_empty() && network != "all" { sort_string = format!("networks/{}{}", network, alt_sort_string); } } if let Some(site) = options.sites.as_deref() { if !site.is_empty() && site != "all" { sort_string = format!("sites/{}{}", site, alt_sort_string); } } if let Some(star) = options.stars.as_deref() { if !star.is_empty() && star != "all" { sort_string = format!("models/{}{}", star, alt_sort_string); } } let video_url = format!("{}/{}/{}/", self.url, sort_string, page); let old_items = match cache.get(&video_url) { Some((time, items)) => { if time.elapsed().unwrap_or_default().as_secs() < 60 * 5 { return Ok(items.clone()); } else { items.clone() } } None => { vec![] } }; let mut requester = requester_or_default(&options, module_path!(), "missing_requester"); let text = match requester.get(&video_url, None).await { Ok(text) => text, Err(e) => { report_provider_error( "omgxxx", "get.request", &format!("url={video_url}; error={e}"), ) .await; return Ok(old_items); } }; let video_items: Vec = self.get_video_items_from_html(text.clone()); if !video_items.is_empty() { cache.remove(&video_url); cache.insert(video_url.clone(), video_items.clone()); } else { return Ok(old_items); } Ok(video_items) } async fn query( &self, cache: VideoCache, page: u8, query: &str, options: ServerOptions, ) -> Result> { let mut search_type = "search"; let mut search_string = query.to_string().to_ascii_lowercase().trim().to_string(); let trimmed = query.trim().trim_start_matches('@').to_ascii_lowercase(); if let Some((kind, raw)) = trimmed.split_once(':') { let candidate = raw.trim().replace(' ', "-"); if !candidate.is_empty() { match kind.trim() { "models" | "model" | "stars" => { search_type = "models"; search_string = candidate; } "sites" | "site" => { search_type = "sites"; search_string = candidate; } "networks" | "network" => { search_type = "networks"; search_string = candidate; } _ => {} } } } match self.stars.read() { Ok(stars) => { if let Some(star) = stars .iter() .find(|s| { s.title.eq_ignore_ascii_case(&search_string) || s.id.eq_ignore_ascii_case(&search_string) }) { search_type = "models"; search_string = star.id.clone(); } } Err(e) => { report_provider_error_background("omgxxx", "query.stars_read", &e.to_string()); } } match self.sites.read() { Ok(sites) => { if let Some(site) = sites .iter() .find(|s| { s.title.eq_ignore_ascii_case(&search_string) || s.id.eq_ignore_ascii_case(&search_string) }) { search_type = "sites"; search_string = site.id.clone(); } } Err(e) => { report_provider_error_background("omgxxx", "query.sites_read", &e.to_string()); } } match self.networks.read() { Ok(networks) => { if let Some(network) = networks .iter() .find(|n| { n.title.eq_ignore_ascii_case(&search_string) || n.id.eq_ignore_ascii_case(&search_string) }) { search_type = "networks"; search_string = network.id.clone(); } } Err(e) => { report_provider_error_background("omgxxx", "query.networks_read", &e.to_string()); } } let mut video_url = format!("{}/{}/{}/{}/", self.url, search_type, search_string, page); video_url = video_url.replace(" ", "+"); // Check our Video Cache. If the result is younger than 1 hour, we return it. let old_items = match cache.get(&video_url) { Some((time, items)) => { if time.elapsed().unwrap_or_default().as_secs() < 60 * 5 { return Ok(items.clone()); } else { let _ = cache.check().await; return Ok(items.clone()); } } None => { vec![] } }; let mut requester = requester_or_default(&options, module_path!(), "missing_requester"); let text = match requester.get(&video_url, None).await { Ok(text) => text, Err(e) => { report_provider_error( "omgxxx", "query.request", &format!("url={video_url}; error={e}"), ) .await; return Ok(old_items); } }; let video_items: Vec = self.get_video_items_from_html(text.clone()); if !video_items.is_empty() { cache.remove(&video_url); cache.insert(video_url.clone(), video_items.clone()); } else { return Ok(old_items); } Ok(video_items) } fn get_site_id_from_name(&self, site_name: &str) -> Option { // site_name.to_lowercase().replace(" ", "") let sites_guard = match self.sites.read() { Ok(guard) => guard, Err(e) => { report_provider_error_background( "omgxxx", "get_site_id_from_name.sites_read", &e.to_string(), ); return None; } }; for site in sites_guard.iter() { if site .title .to_lowercase() .replace(" ", "") .replace(".com", "") == site_name.to_lowercase().replace(" ", "") { return Some(site.id.clone()); } } return None; } fn extract_tag_entries(&self, video_segment: &str) -> Vec<(String, String)> { let fragment = Html::parse_fragment(video_segment); let selector = Selector::parse("div.models a").expect("valid omgxxx models selector"); fragment .select(&selector) .filter_map(|anchor| { let href = anchor.value().attr("href")?.to_string(); let title = anchor .text() .collect::>() .join(" ") .split_whitespace() .collect::>() .join(" "); if title.is_empty() { return None; } Some((href, title)) }) .collect() } fn get_video_items_from_html(&self, html: String) -> Vec { if html.is_empty() { println!("HTML is empty"); return vec![]; } let mut items: Vec = Vec::new(); if !html.contains("class=\"item\"") { return items; } let raw_videos = html .split("videos_list_pagination") .collect::>() .get(0) .copied() .unwrap_or_default() .split(" class=\"pagination\" ") .collect::>() .get(0) .copied() .unwrap_or_default() .split("class=\"list-videos\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("class=\"item\"") .collect::>()[1..] .to_vec(); for video_segment in &raw_videos { // let vid = video_segment.split("\n").collect::>(); // for (index, line) in vid.iter().enumerate() { // println!("Line {}: {}", index, line); // } let video_url: String = video_segment .split(">() .get(1) .copied() .unwrap_or_default() .split("\"") .collect::>() .get(0) .copied() .unwrap_or_default() .to_string(); let mut title = video_segment .split(" title=\"") .collect::>() .get(1) .copied() .unwrap_or_default() .split("\"") .collect::>() .get(0) .copied() .unwrap_or_default() .to_string(); // html decode title = decode(title.as_bytes()).to_string().unwrap_or(title); let id = video_url .split("/") .collect::>() .get(4) .copied() .unwrap_or_default() .to_string(); // Skip advertisement cards. They reuse class="item" but link to an // external ad network instead of an omg.xxx video (and embed an // "## .to_string(); let items = provider.get_video_items_from_html(html); // The advertisement card must be filtered out. assert_eq!(items.len(), 2); assert!(items.iter().all(|item| item.url.contains("/videos/"))); assert!( !items .iter() .any(|item| item.title.contains("AI Cum Slut")) ); // Thumbnails must be real CDN URLs, never empty or base64 placeholders. for item in &items { assert!( item.thumb.starts_with("https://img.omg.xxx/"), "unexpected thumb: {:?}", item.thumb ); assert!(!item.thumb.starts_with("data:")); } assert_eq!(items[0].id, "93816267"); assert_eq!( items[0].thumb, "https://img.omg.xxx/93816000/93816267/medium@2x/1.jpg" ); assert_eq!(items[1].id, "93816269"); assert_eq!( items[1].thumb, "https://img.omg.xxx/93816000/93816269/medium@2x/1.jpg" ); } } #[async_trait] impl Provider for OmgxxxProvider { async fn get_videos( &self, cache: VideoCache, pool: DbPool, sort: String, query: Option, page: String, per_page: String, options: ServerOptions, ) -> Vec { let _ = per_page; let _ = pool; let videos: std::result::Result, Error> = match query { Some(q) => { self.query(cache, page.parse::().unwrap_or(1), &q, options) .await } None => { self.get(cache, page.parse::().unwrap_or(1), &sort, options) .await } }; match videos { Ok(v) => v, Err(e) => { println!("Error fetching videos: {}", e); vec![] } } } fn get_channel(&self, clientversion: ClientVersion) -> Option { Some(self.build_channel(clientversion)) } async fn get_uploader( &self, cache: VideoCache, pool: DbPool, uploader_id: Option, uploader_name: Option, query: Option, profile_content: bool, options: ServerOptions, ) -> std::result::Result, String> { let _ = pool; let Some(target) = self.resolve_uploader_target(uploader_id.as_deref(), uploader_name.as_deref()) else { return Ok(None); }; self.build_uploader_profile(cache, &target, query.as_deref(), profile_content, &options) .await .map_err(|error| error.to_string()) } }