AI ਬਨਾਮ Fanfiction: AO3 'ਤੇ Claude Detection ਨੂੰ ਲੈ ਕੇ ਜੰਗ
Fanfiction ਦੀ ਰਚਨਾਤਮਕ ਦੁਨੀਆ ਇੱਕ ਡਿਜੀਟਲ ਘਰੇਲੂ ਯੁੱਧ (civil war) ਦਾ ਸਾਹਮਣਾ ਕਰ ਰਹੀ ਹੈ ਕਿਉਂਕਿ ਭਾਈਚਾਰੇ ਦੇ ਮੈਂਬਰ ਆਪਣੀਆਂ ਰੈਂਕਾਂ ਵਿੱਚੋਂ generative AI ਨੂੰ ਬਾਹਰ ਕੱਢਣ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰ ਰਹੇ ਹਨ। Anthropic ਦੇ Claude ਮਾਡਲ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾਉਣ ਵਾਲੀ ਇੱਕ ਨਵੀਂ, ਵਿਵਾਦਪੂਰਨ ਡਿਟੈਕਸ਼ਨ (detection) ਵਿਧੀ ਸਾਹਮਣੇ ਆਈ ਹੈ, ਜਿਸ ਨਾਲ ਗਲਤ ਪਛਾਣ (false positives) ਅਤੇ ਤਕਨੀਕੀ ਅਸਮਰੱਥਾ ਦੇ ਡਰ ਪੈਦਾ ਹੋ ਗਏ ਹਨ।
@heatedrivalryai "Claude Detector" ਦਾ ਉਭਾਰ
ਸਾਲਾਂ ਤੋਂ, ਮਨੁੱਖੀ ਰਚਨਾਕਾਰਾਂ ਅਤੇ ChatGPT ਅਤੇ Claude ਵਰਗੇ AI ਮਾਡਲਾਂ ਵਿਚਕਾਰ ਤਣਾਅ ਰਚਨਾਤਮਕ ਖੇਤਰਾਂ ਵਿੱਚ ਬਣਿਆ ਹੋਇਆ ਹੈ। ਜਦੋਂ ਕਿ ਪਾਠਕ ਰਵਾਇਤੀ ਤੌਰ 'ਤੇ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ (subjective cues) 'ਤੇ ਨਿਰਭਰ ਕਰਦੇ ਆਏ ਹਨ—ਜਿਵੇਂ ਕਿ "purple prose" ਜਾਂ ਵਾਧੂ em dashes ਵਰਗੇ ਖਾਸ ਵਿਰਾਮ ਚਿੰਨ੍ਹ—X (ਪਹਿਲਾਂ Twitter) 'ਤੇ ਇੱਕ ਨਵਾਂ ਤਕਨੀਕੀ ਤਰੀਕਾ ਸਾਹਮਣੇ ਆਇਆ ਹੈ।
ਇੱਕ ਅਣਪਛਾਤੇ ਖਾਤੇ, @heatedrivalryai, ਨੇ Archive of Our Own (AO3), ਜੋ ਕਿ ਦੁਨੀਆ ਦਾ ਸਭ ਤੋਂ ਵੱਡਾ fanfiction ਰਿਪੋਜ਼ੀਟਰੀ ਹੈ, ਲਈ ਇੱਕ ਵਿਸ਼ੇਸ਼ "skin" ਜਾਂ ਬ੍ਰਾਊਜ਼ਰ ਐਕਸਟੈਂਸ਼ਨ ਪੇਸ਼ ਕੀਤੀ ਹੈ। ਪਿਛਲੀਆਂ ਗੁਣਾਤਮਕ ਵਿਧੀਆਂ ਦੇ ਉਲਟ, ਇਹ ਟੂਲ ਇੱਕ ਖਾਸ ਤਕਨੀਕੀ artifact ਦੀ ਪਛਾਣ ਕਰਨ ਦਾ ਦਾਅਵਾ ਕਰਦਾ ਹੈ: ਇੱਕ ਲੁਕਿਆ ਹੋਇਆ HTML tag। ਡਿਵੈਲਪਰ ਦੇ ਅਨੁਸਾਰ, ਜਦੋਂ ਕੋਈ ਉਪਭੋਗਤਾ Anthropic ਦੇ Claude ਇੰਟਰਫੇਸ ਤੋਂ ਸਿੱਧਾ ਟੈਕਸਟ ਕਾਪੀ ਕਰਦਾ ਹੈ ਅਤੇ ਇਸਨੂੰ AO3 ਐਡੀਟਰ ਵਿੱਚ ਪੇਸਟ ਕਰਦਾ ਹੈ, ਤਾਂ ਟੈਕਸਟ ਵਿੱਚ ਇੱਕ ਖਾਸ ਕੋਡ ਸਨਿਪੇਟ ਰਹਿ ਜਾਂਦਾ ਹੈ: font-claude-response-body।
ਡਿਟੈਕਸ਼ਨ ਮਕੈਨਿਜ਼ਮ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
ਇਹ ਮਕੈਨਿਜ਼ਮ ਬਹੁਤ ਹੀ ਸਪੱਸ਼ਟ (binary) ਹੈ। ਜਦੋਂ AO3 skin ਕਿਸੇ ਕਾਰਜ ਦੇ metadata ਜਾਂ body ਦੇ ਅੰਦਰ ਇਸ ਖਾਸ "Claude-injected" ਕੋਡ ਦਾ ਪਤਾ ਲਗਾਉਂਦੀ ਹੈ, ਤਾਂ ਇਹ ਪੂਰੇ ਪੇਜ ਦੇ ਬੈਕਗ੍ਰਾਊਂਡ ਨੂੰ ਲਾਲ ਕਰਕੇ ਇੱਕ ਵਿਜ਼ੂਅਲ ਅਲਰਟ ਜਾਰੀ ਕਰ ਦਿੰਦੀ ਹੈ।
ਟੈਸਟਿੰਗ ਨੇ ਇਸ ਖਾਸ ਵਿਧੀ ਦੀ ਤਕਨੀਕੀ ਪ੍ਰਭਾਵਸ਼ੀਲਤਾ ਦੀ ਪੁਸ਼ਟੀ ਕੀਤੀ ਹੈ। ਜਦੋਂ Claude ਦੁਆਰਾ ਤਿਆਰ ਕੀਤੀ ਗਈ ਕਹਾਣੀ ਨੂੰ ਚੈਟਬੋਟ ਤੋਂ ਸਿੱਧਾ AO3 ਐਡੀਟਰ ਵਿੱਚ ਪੇਸਟ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਤਾਂ "red screen" ਅਲਰਟ ਤੁਰੰਤ ਸਰਗਰਮ ਹੋ ਜਾਂਦਾ ਹੈ। ਹਾਲਾਂਕਿ, ਇਹ ਡਿਟੈਕਸ਼ਨ ਇਨਪੁਟ ਦੇ ਤਰੀਕੇ ਪ੍ਰਤੀ ਬਹੁਤ ਸੰਵੇਦਨਸ਼ੀਲ ਹੈ। ਜੇਕਰ ਕੋਈ ਉਪਭੋਗਤਾ ਉਹੀ AI-ਨਿਰਮਿਤ ਟੈਕਸਟ ਲੈਂਦਾ ਹੈ ਪਰ ਇਸਨੂੰ plain text ਵਜੋਂ ਪੇਸਟ ਕਰਦਾ ਹੈ (formatting ਹਟਾ ਕੇ), ਤਾਂ ਲਾਲ ਅਲਰਟ ਖਤਮ ਹੋ ਜਾਂਦਾ ਹੈ। ਇਹ ਇੱਕ ਮਹੱਤਵਪੂਰਨ ਅੰਤਰ ਨੂੰ ਦਰਸਾਉਂਦਾ ਹੈ: ਇਹ ਟੂਲ "AI ਲਿਖਣ ਸ਼ੈਲੀ" ਦੀ ਪਛਾਣ ਨਹੀਂ ਕਰ ਰਿਹਾ, ਸਗੋਂ "copy-paste" ਕਾਰਵਾਈ ਦੇ ਅਣਜਾਣੇ ਰਹਿ ਗਏ ਨਿਸ਼ਾਨਾਂ ਦੀ ਪਛਾਣ ਕਰ ਰਿਹਾ ਹੈ।
ਰਚਨਾਤਮਕ ਭਾਈਚਾਰਿਆਂ ਵਿੱਚ ਨੁਕਸਾਨ ਦਾ ਖਤਰਾ
ਹਾਲਾਂਕਿ ਇਹ ਟੂਲ ਸਿੱਧੇ ਤੌਰ 'ਤੇ copy-pasting ਦੀ ਪਛਾਣ ਕਰਨ ਵਿੱਚ ਪ੍ਰਭਾਵਸ਼ਾਲੀ ਹੈ, ਪਰ ਇਹ ਵਿਆਪਕ fanfiction ecosystem ਲਈ ਮਹੱਤਵਪੂਰਨ ਜੋਖਮ ਪੇਸ਼ ਕਰਦਾ ਹੈ। ਮੁੱਖ ਚਿੰਤਾ ਇਹ ਹੈ ਕਿ AI ਨੂੰ "ਜੜ੍ਹੋਂ ਖਤਮ" ਕਰਨ ਦੀ ਮੁਹਿੰਮ ਸ਼ੱਕ ਦੇ ਮਾਹੌਲ ਨੂੰ ਜਨਮ ਦੇ ਸਕਦੀ ਹੈ ਜਿੱਥੇ ਜਾਇਜ਼ ਮਨੁੱਖੀ ਲੇਖਕ ਇਸ ਦਖਲਅੰਦਾਜ਼ੀ ਦੀ ਲਪੇਟ ਵਿੱਚ ਆ ਸਕਦੇ ਹਨ।
"AI ਨੂੰ ਇੱਕ ਸਾਧਨ ਵਜੋਂ ਵਰਤਣ" ਅਤੇ "AI-ਨਿਰਮਿਤ plagiarism" ਵਿਚਕਾਰ ਅੰਤਰ ਡਿਜੀਟਲ ਨੈਤਿਕਤਾ ਵਿੱਚ ਪਹਿਲਾਂ ਹੀ ਇੱਕ ਗੁੰਝਲਦਾਰ (grey area) ਮੁੱਦਾ ਹੈ। ਹਮਲਾਵਰ, ਆਟੋਮੇਟਡ ਡਿਟੈਕਸ਼ਨ ਵਿਧੀਆਂ ਨੂੰ ਲਾਗੂ ਕਰਕੇ, ਭਾਈਚਾਰਾ "ਜਦੋਂ ਤੱਕ ਬੇਗੁਨਾਹ ਸਾਬਤ ਨਾ ਹੋ ਜਾਵੇ, ਉਦੋਂ ਤੱਕ ਦੋਸ਼ੀ" ਵਾਲਾ ਮਾਹੌਲ ਬਣਾਉਣ ਦਾ ਜੋਖਮ ਲੈਂਦਾ ਹੈ। ਇਸ ਤੋਂ ਇਲਾਵਾ, ਜਿਵੇਂ-ਜਿਵੇਂ LLMs ਲਿਖਣ ਦੇ ਕੰਮਕਾਜ ਵਿੱਚ ਵਧੇਰੇ ਸ਼ਾਮਲ ਹੁੰਦੇ ਜਾ ਰਹੇ ਹਨ, ਇੱਕ ਮਨੁੱਖ ਦੁਆਰਾ ਸੰਪਾਦਿਤ AI ਡਰਾਫਟ ਅਤੇ ਸ਼ੁੱਧ AI ਆਉਟਪੁੱਟ ਵਿਚਕਾਰ ਲਕੀਰਧਾਰੀ ਬਿਹਤਰ ਤਰੀਕੇ ਨਾਲ ਧੁੰਦਲੀ ਹੁੰਦੀ ਜਾ ਰਹੀ ਹੈ, ਜਿਸ ਨਾਲ ਤਕਨੀਕੀ "artifacts" ਪ੍ਰਮਾਣਿਕਤਾ ਲਈ ਇੱਕ ਅਸਥਿਰ ਮਾਪਦੰਡ ਬਣ ਜਾਂਦੇ ਹਨ।
ਮੁੱਖ ਨੁਕਤੇ
- ਤਕਨੀਕੀ ਡਿਟੈਕਸ਼ਨ: ਇੱਕ ਨਵੀਂ AO3 skin
font-claude-response-bodyਕੋਡ artifact ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾਉਂਦੀ ਹੈ, ਜੋ Anthropic ਦੇ Claude ਤੋਂ ਸਿੱਧਾ ਪੇਸਟ ਕਰਨ ਵੇਲੇ ਰਹਿ ਜਾਂਦਾ ਹੈ। - ਵਿਧੀ ਵਿੱਚ ਖਾਮੀ: ਡਿਟੈਕਟਰ ਪੇਸਟ ਕਰਨ ਦੇ ਤਰੀਕੇ ਦੀ ਪਛਾਣ ਕਰਦਾ ਹੈ ਨਾ ਕਿ ਗਦ (prose) ਦੀ ਪ੍ਰਕਿਰਤੀ ਦੀ, ਜਿਸਦਾ ਮਤਲਬ ਹੈ ਕਿ ਜੇਕਰ ਫਾਰਮੈਟਿੰਗ ਹਟਾ ਦਿੱਤੀ ਜਾਵੇ ਤਾਂ AI ਟੈਕਸਟ ਡਿਟੈਕਸ਼ਨ ਤੋਂ ਬਚ ਸਕਦਾ ਹੈ।
- ਭਾਈਚਾਰੇ 'ਤੇ ਪ੍ਰਭਾਵ: ਇਹ ਕਦਮ generative AI ਦੀ ਉਪਯੋਗਤਾ ਅਤੇ ਮਨੁੱਖ-ਕੇਂਦ੍ਰਿਤ ਰਚਨਾਤਮਕ ਖੇਤਰਾਂ ਦੀ ਸੰਭਾਲ ਵਿਚਕਾਰ ਵਧਦੇ ਟਕਰਾਅ ਦਾ ਸੰਕੇਤ ਦਿੰਦਾ ਹੈ।
