Anthropic ಸಂಸ್ಥೆಯು ಸೆಪ್ಟೆಂಬರ್ 1 ರಂದು Claude Fable 5.1 ಮತ್ತು Claude Mythos 5.1 ಅನ್ನು ಬಿಡುಗಡೆ ಮಾಡಿದೆ. ಎರಡೂ ಮಾಡೆಲ್ಗಳು ಈಗ 1 ಮಿಲಿಯನ್ ಟೋಕನ್ಗಳ ಕಾಂಟೆಕ್ಸ್ಟ್ ಅನ್ನು ಸ್ವೀಕರಿಸುತ್ತವೆ, 128k ಟೋಕನ್ಗಳವರೆಗೆ ಔಟ್ಪುಟ್ ನೀಡಬಲ್ಲವು ಮತ್ತು ಪ್ರತಿ ಕರಾವರಣದ (per-call) ವೆಚ್ಚವನ್ನು ಕಡಿಮೆ ಮಾಡುವ ಜೊತೆಗೆ ತಮ್ಮ ತರ್ಕದ ಆಳವನ್ನು (reasoning depth) ತಕ್ಷಣವೇ ಹೊಂದಿಸಿಕೊಳ್ಳಬಲ್ಲವು. ಈ ಮೇಲ್ದರ್ಜೆಗೇರಿಸುವಿಕೆಗಳು ಕೇವಲ ವೇಗದ ಬೆಂಚ್ಮಾರ್ಕ್ ಸ್ಕೋರ್ಗಳನ್ನು ಗುರಿಯಾಗಿಸದೆ, ಅಗ್ಗದ, ಹೆಚ್ಚು ವಿಶ್ವಾಸಾರ್ಹ AI-ಸಹಾಯಿತ ಕೋಡಿಂಗ್ ಮತ್ತು ಹೆಚ್ಚಿನ ಪ್ರಾಮುಖ್ಯತೆಯ ಸಂಶೋಧನೆಯನ್ನು ಗುರಿಯಾಗಿಸಿಕೊಂಡಿವೆ.
ಹೊಸ ಆವೃತ್ತಿಗಳು ಏಕೆ ಮುಖ್ಯ
ಹಿಂದಿನ Claude ತಲೆಮಾರಿನವು ಕಾಂಟೆಕ್ಸ್ಟ್ ವಿಂಡೋಗಳನ್ನು ಕೆಲವು ಸಾವಿರ ಟೋಕನ್ಗಳಿಗೆ ಸೀಮಿತಗೊಳಿಸಿದ್ದವು, ಇದರಿಂದಾಗಿ ಡೆವಲಪರ್ಗಳು ಕೋಡ್ ಅಥವಾ ಡೇಟಾವನ್ನು ಕೈಯಾರೆ ವಿಭಜಿಸಬೇಕಾಗುತ್ತಿತ್ತು. ಬಳಕೆದಾರರು ತರ್ಕದ ಆಳವನ್ನು (reasoning depth) ಸಹ ಮ್ಯಾನುಯಲ್ ಆಗಿ ಹೊಂದಿಸಬೇಕಾಗುತ್ತಿತ್ತು, ಇದು ಸರಳ ಪ್ರಾಂಪ್ಟ್ ಅನ್ನು ಪ್ರಯೋಗ ಮತ್ತು ತಪ್ಪುಗಳ (trial-and-error) ಆಟವನ್ನಾಗಿ ಮಾಡುತ್ತಿತ್ತು. ಕ್ಯಾಶ್-ರೀಡ್ (Cache-read) ಶುಲ್ಕಗಳಿಂದಾಗಿ ದೀರ್ಘ ಅವಧಿಯ ಸೆಷನ್ಗಳು ಮತ್ತು ಪದೇ ಪದೇ ಟೂಲ್ ಕರೆಗಳು ದುಬಾರಿಯಾಗುತ್ತಿದ್ದವು, ಮತ್ತು ಭದ್ರತಾ ತಂಡಗಳು ಕೋಡ್ ಪರಿಶೀಲನೆಯನ್ನು ನಿಧಾನಗೊಳಿಸುವ ಸುಳ್ಳು-ಪಾಸಿಟಿವ್ (false-positive) ಎಚ್ಚರಿಕೆಗಳ ಬಗ್ಗೆ ದೂರು ನೀಡುತ್ತಿದ್ದವು.
Claude Fable 5.1 ಮತ್ತು Claude Mythos 5.1 ಈ ಸಮಸ್ಯೆಗಳನ್ನು ನೇರವಾಗಿ ಎದುರಿಸುತ್ತವೆ. ಇವೆರಡೂ ಒಂದೇ ರೀತಿಯ ಮೂಲ ಮೆದುಳನ್ನು ಹೊಂದಿದ್ದರೂ, Anthropic ತನ್ನ ಗುರಿಿತ ಪ್ರೇಕ್ಷಕರಿಗಾಗಿ ಪ್ರತಿಯೊಂದು ಮಾಡೆಲ್ಗೆ ವಿಭಿನ್ನ ಗಾರ್ಡ್ರೈಲ್ಗಳನ್ನು (guardrails) ಅನ್ವಯಿಸುತ್ತದೆ.
ಬದಲಾವಣೆಗಳು ವಾಸ್ತವವಾಗಿ ಏನು ಮಾಡುತ್ತವೆ
- ಕಡಿಮೆ ವೆಚ್ಚಗಳು – Anthropic ಕ್ಯಾಶ್ ರೀಡ್ಗಳ ಬೆಲೆಯನ್ನು ಕಡಿಮೆ ಮಾಡಿದೆ, ಆದ್ದರಿಂದ ದೀರ್ಘವಾದ, ಪುನರಾವರ್ತಿತ ಕೋಡಿಂಗ್ ಸೆಷನ್ಗಳು ಮತ್ತು ಪದೇ ಪದೇ ಟೂಲ್ ಕರೆಗಳು ಈಗ ಗಮನಾರ್ಹವಾಗಿ ಕಡಿಮೆ ವೆಚ್ಚದಲ್ಲಿವೆ—ಇದು ಸ್ಟಾರ್ಟ್ಅಪ್ಗಳು ಮತ್ತು ಇನ್-ಹೌಸ್ ಡೆವ್ ತಂಡಗಳಿಗೆ ನಿರ್ಣಾಯಕ ಅಂಶವಾಗಿದೆ.
- ಅಡಾಪ್ಟಿವ್ ಥಿಂಕಿಂಗ್ (ಹೊಂದಿಕೊಳ್ಳುವ ಆಲೋಚನೆ) – ಒಂದು ಕಾರ್ಯಕ್ಕೆ ಎಷ್ಟು ತರ್ಕದ ಅಗತ್ಯವಿದೆ ಎಂಬುದನ್ನು ಮಾಡೆಲ್ ತಕ್ಷಣವೇ ನಿರ್ಧರಿಸುತ್ತದೆ. ಬಳಕೆದಾರರು ಇನ್ನು ಮುಂದೆ "ಪ್ರಯತ್ನದ ಮಟ್ಟಗಳನ್ನು" (effort levels) ಬದಲಾಯಿಸುವ ಅಥವಾ ಎಷ್ಟು chain-of-thought ಪ್ರಾಂಪ್ಟಿಂಗ್ ಅಗತ್ಯವಿದೆ ಎಂದು ಊಹಿಸುವ ಅಗತ್ಯವಿಲ್ಲ.
- ಟರ್ನ್-ಸ್ಕೋಪ್ಡ್ ಮೆಸೇಜ್ಗಳು – ಸಿಸ್ಟಮ್-ಮಟ್ಟದ ಸೂಚನೆಗಳು ಕೇವಲ ಒಂದು ಸಂವಹನಕ್ಕೆ ಮಾತ್ರ ಅನ್ವಯಿಸುತ್ತವೆ, ಇದು ಹಳೆಯ ನಿರ್ದೇಶನಗಳು ನಂತರದ ಸಂವಹನಗಳನ್ನು ಕಲುಷಿತಗೊಳಿಸದಂತೆ ತಡೆಯುತ್ತದೆ.
- ಭದ್ರತಾ ಸುಧಾರಣೆಗಳು – Claude Code ಬಳಕೆದಾರರು ಸೈಬರ್ ಸೆಕ್ಯೂರಿಟಿ ಸುಳ್ಳು-ಪಾಸಿಟಿವ್ಗಳಲ್ಲಿ ಸುಮಾರು 60% ಕಡಿತವನ್ನು ವರದಿ ಮಾಡಿದ್ದಾರೆ, ಇದು ಕಾಲ್ಪನಿಕ ಎಚ್ಚರಿಕೆಗಳ ಹಿಂದೆ ವ್ಯಯಿಸುವ ಸಮಯವನ್ನು ಕಡಿಮೆ ಮಾಡುತ್ತದೆ.
- ದೌರ್ಬಲ್ಯಗಳ ಪತ್ತೆ – Fable 5.1 ಸಾಫ್ಟ್ವೇರ್ ದೋಷಗಳನ್ನು ಪತ್ತೆಹಚ್ಚುತ್ತದೆ ಆದರೆ ಎಕ್ಸ್ಪ್ಲಾಯ್ಟ್ ಕೋಡ್ (exploit code) ಅನ್ನು ರಚಿಸುವುದನ್ನು ನಿಷೇಧಿಸಲಾಗಿದೆ, ಇದು ದುರುದ್ದೇಶಪೂರಿತ ವ್ಯಕ್ತಿಗಳಿಗೆ ಅವಕಾಶ ನೀಡದೆ ಆಡಿಟರ್ಗಳು ಉತ್ಪಾದಕವಾಗಿರಲು ಸಹಾಯ ಮಾಡುತ್ತದೆ.
- ಹೆಚ್ಚಿನ ಪ್ರಾಮುಖ್ಯತೆಯ ಸಂಶೋಧನೆಯ ಮೇಲೆ ಗಮನ – Mythos 5.1 ಸೈಬರ್ ಸೆಕ್ಯೂರಿಟಿ ಮತ್ತು ಲೈಫ್ ಸೈನ್ಸಸ್ನಲ್ಲಿನ ವಿಶ್ವಾಸಾರ್ಹ ಕಾರ್ಯಕ್ರಮಗಳಿಗೆ ಸೇವೆ ಸಲ್ಲಿಸುತ್ತದೆ. Anthropic ಇದನ್ನು ಸೈಫರ್ ಡಿಸೈನ್ನಂತಹ ಕಾರ್ಯಗಳ ಮೇಲೆ ಸ್ಟ್ರೆಸ್-ಟೆಸ್ಟ್ ಮಾಡುತ್ತದೆ, ನಂತರ ಆ ಒಳನೋಟಗಳನ್ನು ಸಾಮಾನ್ಯ ಉದ್ದೇಶದ Fable ಮಾಡೆಲ್ಗೆ ನೀಡುತ್ತದೆ.
ಯಾರು ಲಾಭ ಪಡೆಯುತ್ತಾರೆ ಮತ್ತು ಯಾರು ಹೊರಗುಳಿಯಬಹುದು
IDE ಅಸಿಸ್ಟೆಂಟ್ಗಳು, CI ಪೈಪ್ಲೈನ್ಗಳು ಅಥವಾ ಕಸ್ಟಮ್ ಬಾಟ್ಗಳನ್ನು ನಿರ್ಮಿಸುವ ಡೆವಲಪರ್ಗಳು ಹಣ ಉಳಿತಾಯ ಮಾಡುತ್ತಾರೆ ಮತ್ತು ಕಡಿಮೆ ಭದ್ರತಾ ತೊಂದರೆಗಳನ್ನು ಎದುರಿಸುತ್ತಾರೆ. Anthropic ನ ವಿಶ್ವಾಸಾರ್ಹತಾ ಮಾನದಂಡಗಳನ್ನು ಪೂರೈಸುವ ಭದ್ರತಾ ವಿಶ್ಲೇಷಕರು ಮತ್ತು ಬಯೋಟೆಕ್ ಸಂಶೋಧಕರು ಸೂಕ್ಷ್ಮ ಕೆಲಸಗಳಿಗಾಗಿ Mythos 5.1 ನ ಕಟ್ಟುನಿಟ್ಟಾದ ಗಾರ್ಡ್ರೈಲ್ಗಳನ್ನು ಬಳಸಬಹುದು. ವಿನಿಮಯ: Mythos ಸಾರ್ವಜನಿಕರಿಗೆ ಮುಕ್ತವಾಗಿಲ್ಲ, ಆದ್ದರಿಂದ ವಿಶ್ವಾಸಾರ್ಹ ಕಾರ್ಯಕ್ರಮದ ಸಂಬಂಧವಿಲ್ಲದ ಸಣ್ಣ ತಂಡಗಳು ಹೆಚ್ಚು ಅನುಮತಿಸುವ Fable 5.1 ಅನ್ನು ಅವಲಂಬಿಸಬೇಕಾಗುತ್ತದೆ.
ಸಂಭಾವ್ಯ ಅನಾನುಕೂಲಗಳು ಅಥವಾ ಮುಕ್ತ ಪ್ರಶ್ನೆಗಳು
ಎಕ್ಸ್ಪ್ಲಾಯ್ಟ್ ಜನರೇಷನ್ ಅನ್ನು ತಡೆಯುವುದು ರೆಡ್-ಟೀಮ್ ಬಳಕೆದಾರರನ್ನು ನಿರಾಶೆಗೊಳಿಸಬಹುದು, ಏಕೆಂದರೆ ರಕ್ಷಣೆಯನ್ನು ಪರೀಕ್ಷಿಸಲು ಅವರಿಗೆ ವಾಸ್ತವಿಕ ಅಟ್ಯಾಕ್ ಕೋಡ್ ಅಗತ್ಯವಿರುತ್ತದೆ. "ವಿಶ್ವಾಸಾರ್ಹ ಕಾರ್ಯಕ್ರಮ" (trusted-program) ಎಂಬ ನಿರ್ಬಂಧವು ಹಂತ-ಹಂತದ AI ಮಾರುಕಟ್ಟೆಯನ್ನು ಸೃಷ್ಟಿಸಬಹುದು, ಅಲ್ಲಿ ಕೇವಲ ಉತ್ತಮವಾಗಿ ಧನಸಹಾಯ ಪಡೆದ ಸಂಸ್ಥೆಗಳು ಅತ್ಯಂತ ಸುರಕ್ಷಿತ ಮತ್ತು ಹೆಚ್ಚಿನ ಸಾಮರ್ಥ್ಯದ ಮಾಡೆಲ್ ಅನ್ನು ಪಡೆಯಬಹುದು. ಕ್ಯಾಶ್-ರೀಡ್ ಬೆಲೆ ಇಳಿಕೆಯಾಗಿದ್ದರೂ, Anthropic ತನ್ನ ಸಂಪೂರ್ಣ ವೆಚ್ಚದ ಮಾದರಿಯನ್ನು ಬಹಿರಂಗಪಡಿಸಿಲ್ಲ, ಇದು ಬೃಹತ್ ಕೆಲಸದ ಹೊರ workloads ಗಾಗಿ ನಿವ್ವಳ ಉಳಿತಾಯದ ಬಗ್ಗೆ ಡೆವಲಪರ್ಗಳಲ್ಲಿ ಅನಿಶ್ಚಿತತೆಯನ್ನು ಉಳಿಸಿದೆ.
ಮುಂದೆ ಏನನ್ನು ಗಮನಿಸಬೇಕು
ವೆಚ್ಚ ಮತ್ತು ಭದ್ರತೆಯ ಭರವಸೆಗಳು ನೈಜ ಪ್ರಪಂಚದ ಉತ್ಪಾದಕತೆಯ ಲಾಭಗಳಾಗಿ ಬದಲಾಗುತ್ತವೆಯೇ ಎಂಬುದನ್ನು ಅಳವಡಿಕೆಯ ದರಗಳು ತೋರಿಸುತ್ತವೆ. ದೊಡ್ಡ ಕೋಡ್ಬೇಸ್ಗಳಿಗಾಗಿ ಡೆವಲಪರ್ಗಳು 1 M-ಟೋಕನ್ ವಿಂಡೋವನ್ನು ಇಷ್ಟಪಟ್ಟರೆ, Mythos-ಮಟ್ಟದ ಗಾರ್ಡ್ರೈಲ್ಗಳನ್ನು ಹೆಚ್ಚಿನ ಜನರಿಗೆ ತೆರೆಯಲು Anthropic ಮೇಲೆ ಒತ್ತಡ ಬರಬಹುದು. ಹೊಸ ಭದ್ರತಾ ಸ್ಥಿತಿಗತಿ ಅಟ್ಯಾಕ್-ಹೆವಿ ಬಳಕೆಯ ಸಂದರ್ಭದಲ್ಲಿ ಹೇಗೆ ನಿಲ್ಲುತ್ತದೆ ಎಂಬುದನ್ನು ಅಳೆಯಲು ಸುಳ್ಳು-ಪಾಸಿಟಿವ್ ಕಡಿತದ ಆವರ್ತನ ಮತ್ತು ದೌರ್ಬಲ್ಯ-ಸ್ಕ್ಯಾನಿಂಗ್ ಪೈಪ್ಲೈನ್ಗಳ ಮೇಲಿನ ಪರಿಣಾಮವನ್ನು ಗಮನಿಸಿ.
ಸಾರಾಂಶ: Claude Fable 5.1 ಮತ್ತು Claude Mythos 5.1 ಬೆಂಚ್ಮಾರ್ಕ್ಗಳನ್ನು ಮುರಿಯುವ ಗುರಿಯನ್ನು ಹೊಂದಿಲ್ಲ, ಬದಲಾಗಿ ಅತ್ಯಂತ ಸೂಕ್ಷ್ಮ ಅಪ್ಲಿಕೇಶನ್ಗಳಿಗಾಗಿ ಸುರಕ್ಷತಾ ಜಾಲವನ್ನು ಬಿಗಿಗೊಳಿಸುವ ಜೊತೆಗೆ ದೀರ್ಘಾವಧಿಯ AI ವರ್ಕ್ಫ್ಲೋಗಳಿಂದ ವೆಚ್ಚವನ್ನು ಕಡಿಮೆ ಮಾಡುವ ಗುರಿಯನ್ನು ಹೊಂದಿವೆ.
