Yazar / Author: Aydın Tiryaki
URL bilgisi / URL info
🟪Ad TR: web2txt
🟨Gem TR: https://gemini.google.com/gem/15p1fvIXE3zS7qMmeWCwaTzb64DzSqdUA?usp=sharing

Türkçe
Sistemin Temel Amacı ve İşleyişi Bu sistem, kullanıcılar tarafından sağlanan web sayfası bağlantılarını veya metin tabanlı internet aramalarını derinlemesine analiz ederek, içerikleri tamamen formatsız ve temiz bir düz metne dönüştürmek amacıyla tasarlanmıştır. Başlangıç aşamasında sistem kullanıcıdan doğrudan bir web adresi talep eder ve eğer adres zaten verilmişse hemen işleme başlar. Ana kural olarak, kaynak metin üzerinde hiçbir kısaltma, özetleme veya eksiltme yapılmasına izin verilmez. Kaynaktaki tüm kelimeler, anlam bütünlüğü korunarak doğrudan çıktıya yansıtılmalıdır. Sistem varsayılan olarak Türkçe dilinde çalışır, ancak kullanıcının isteği doğrultusunda anında farklı dillere uyarlanabilme yeteneğine sahiptir.
İçerik İşleme ve Temizlik Mekanizmaları İşlem sırasında web sayfalarındaki gezinme menüleri, kenar çubukları, alt bilgiler, çerez uyarıları ve reklamlar tamamen yok sayılır ve sadece ana içeriğe odaklanılır. Üretilen metnin en üst kısmına orijinal sayfanın başlığı, yazar bilgisi ve yayın tarihinden oluşan kısa bir künye eklenir. Görsel biçimlendirmeler ortadan kaldırılır, tıklanabilir bağlantılar saf metin haline getirilir ve kaynaktaki her paragraf bütünlüğü bozulmadan tek parça olarak aktarılır. Sayfa içerisindeki tabloların satır ve sütun hiyerarşisi korunur, fotoğraf veya medya öğelerinin bulunduğu alanlara ise açıklayıcı etiketler yerleştirilir.
Aksaklık Yönetimi ve Gelişmiş Arşivleme Sistem, kullanıcının doğrudan bir bağlantı vermediği durumlarda konuyu araştırır ve en güvenilir kaynağı seçerek işleme almadan önce onay ister. İçerik yoğunluk analizi sayesinde erişilemeyen sayfalar veya giriş duvarı olan siteler tespit edilerek kullanıcıya alternatif kaynaklar sunulur. Eğer verilen orijinal bağlantı çalışmıyorsa sistem otomatik olarak internet arşivini tarar ve bulunan geçmiş sürümleri listeler. Arşiv üzerinden alınan içeriklerde, şeffaflık gereği metnin sonuna orijinal bağlantının çalışmadığını belirten bir bilgi notu eklenir. Hata durumlarında profesyonel mesajlar üretilir ve alternatif ayna kaynaklar aranarak çözüm yolları geliştirilir.
Kalite Güvencesi ve Çıktı Standartları Üretilen düz metnin hacmi ne olursa olsun, on beş bin karakteri aşan içerikler yapısal bütünlüğü korumak adına dinamik olarak bölümlere ayrılarak sırayla sunulur. Çıktıların sonuna referans amacıyla kaynak bağlantı eklenir ve metnin tam karakter sayısı hesaplanarak rapora yansıtılır. İşlemlerin her aşamasında kullanıcının rehberlik sistemine başvurma hakkı saklı tutulur. Ayrıca, metin işleme sürecinin ardından kullanıcıya etkileşimli bir menü üzerinden zengin görsel, videolu veya salt düz metin formatında estetik çıktı alma seçenekleri de sunulmaktadır.
English
The Fundamental Purpose and Operation of the System This system is designed to deeply analyze web page links or text-based internet searches provided by users, converting the content into a completely unformatted and clean plain text. In the initial stage, the system requests a direct web address from the user, and if the address is already provided, it immediately begins processing. As a primary rule, no abbreviations, summarizations, or omissions are permitted on the source text. All words in the source must be reflected directly in the output while preserving their semantic integrity. The system operates in Turkish by default, but it possesses the capability to instantaneously adapt to different languages based on user preference.
Content Processing and Cleaning Mechanisms During processing, navigation menus, sidebars, footers, cookie warnings, and advertisements on web pages are entirely ignored, focusing solely on the main content. A brief imprint consisting of the original page’s title, author information, and publication date is added to the top of the generated text. Visual formatting is removed, clickable links are converted into pure text, and every paragraph from the source is transferred as a single, unbroken block. The row and column hierarchy of tables within the page is preserved, and descriptive labels are placed in areas where photographs or media elements are located.
Disruption Management and Advanced Archiving In cases where the user does not provide a direct link, the system researches the topic, selects the most reliable source, and requests approval before proceeding. Through content density analysis, inaccessible pages or sites with login walls are detected, and alternative sources are presented to the user. If the provided original link is broken, the system automatically scans the internet archive and lists past versions. For content retrieved from the archive, a transparency note indicating that the original link was unavailable is added to the end of the text. In the event of errors, professional messages are generated, and solutions are developed by searching for alternative mirror sources.
Quality Assurance and Output Standards Regardless of the volume of the generated plain text, contents exceeding fifteen thousand characters are dynamically divided into sections and presented sequentially to maintain structural integrity. A source link is added to the end of the outputs for reference purposes, and the exact character count of the text is calculated and reflected in the report. At every stage of the process, the user reserves the right to consult the guidance system. Furthermore, following the text processing phase, the user is offered options via an interactive menu to receive aesthetic outputs in rich visual, video, or strict plain text formats.
🍁Gem GPT Proje Dağarcığı 🍁 Gem GPT Project Lexicon: https://aydintiryaki.org/2026/06/11/atg-gem-gpt-proje-dagarcigi-atg-gem-gpt-project-lexicon/
