Claude Fable 5.1 ಈಗ ಮಾರುಕಟ್ಟೆಗೆ ಬಂದಿದೆ, ಮತ್ತು ಸಾಮಾನ್ಯ ಚಾಟ್‌ಗೆ 25% ಮತ್ತು ಅನೇಕ ಆಟೊಮೇಷನ್ ಟೂಲ್‌ಗಳಿಗೆ ಶಕ್ತಿಯನ್ನು ನೀಡುವ ಪುನರಾವರ್ತಿತ-ಪ್ರಾಂಪ್ಟ್ ಏಜೆಂಟ್ ಲೂಪ್‌ಗಳಿಗೆ (repeated-prompt agent loops) 45% ಕಡಿಮೆ ವೆಚ್ಚವಾಗುತ್ತದೆ ಎಂದು Anthropic ಹೇಳಿದೆ. ಕಂಪನಿಯು ಈಗಾಗಲೇ ಪ್ರೊಸೆಸ್ ಮಾಡಿ ಸಂಗ್ರಹಿಸಿರುವ ಮಾಹಿತಿಯಾದ ಕ್ಯಾಶ್ ಮಾಡಲಾದ ಡೇಟಾ (cached data) ಅನ್ನು ಅಗ್ಗದ ದರದಲ್ಲಿ ಪಡೆಯುವುದರಿಂದ ಈ ಬೆಲೆ ಇಳಿಕೆಯಾಗಿದೆ.

ಬೆಲೆ ಇಳಿಕೆಯು ಏಕೆ ಮುಖ್ಯ?

ಭಾಷಾ ಮಾದರಿಗೆ (language model) ಹೆಚ್ಚಿನ ಸಂಖ್ಯೆಯ ಕರೆಗಳನ್ನು ಮಾಡುವ ಡೆವಲಪರ್‌ಗಳ ಬಿಲ್ ಹೆಚ್ಚಾಗುವುದು ಸಾಮಾನ್ಯ, ಏಕೆಂದರೆ ಪ್ರದರ್ಶಕರು (provider) ಈಗಾಗಲೇ ತಮ್ಮ ಕ್ಯಾಶ್‌ನಲ್ಲಿ ಹೊಂದಿರುವ ವಿಷಯವನ್ನು ಪುನರಾವರ್ತಿಸಿದರೂ ಸಹ, ಪ್ರತಿಯೊಂದು ವಿನಂತಿಯನ್ನು ಮಾದರಿಯ ಪ್ರತಿ-ಟೋಕನ್ ದರದಲ್ಲಿ (per-token rate) ಬಿಲ್ ಮಾಡಲಾಗುತ್ತದೆ. ಕ್ಯಾಶ್ ಮಾಡಲಾದ ಡೇಟಾವನ್ನು ಬಳಸಿಕೊಳ್ಳುವ ಮೂಲಕ, Fable 5.1 "ಸ್ಟ್ಯಾಂಡರ್ಡ್" ವಿನಂತಿಗಳ ವೆಚ್ಚವನ್ನು ಕಡಿಮೆ ಮಾಡುತ್ತದೆ ಮತ್ತು ಅನೇಕ ಇಟರೇಷನ್‌ಗಳಲ್ಲಿ ಒಂದೇ ಸಿಸ್ಟಮ್ ಪ್ರಾಂಪ್ಟ್ ಮತ್ತು ಟೂಲ್ ಸ್ಕೀಮಾವನ್ನು ಮರುಬಳಕೆ ಮಾಡಿದಾಗ ಹೆಚ್ಚಿನ ರಿಯಾಯಿತಿಯನ್ನು ನೀಡುತ್ತದೆ. ಏಜೆಂಟ್ ಪೈಪ್‌ಲೈನ್‌ಗಳನ್ನು ನಿರ್ಮಿಸಿರುವ ತಂಡಗಳಿಗೆ—ಉದಾಹರಣೆಗೆ ಸ್ವಾಯತ್ತ ಕೋಡ್ ವಿಮರ್ಶಕರು (autonomous code reviewers), ಟಿಕೆಟ್-ಟ್ರಯಾಜ್ ಬಾಟ್‌ಗಳು (ticket-triage bots), ಅಥವಾ ಡೇಟಾ-ಎಕ್ಸ್‌ಟ್ರಾಕ್ಷನ್ ಲೂಪ್‌ಗಳು (data-extraction loops)—ಈ 45% ಉಳಿತಾಯವು ನಿರ್ಣಾಯಕವಾಗಬಹುದು.

ಬದಲಾವಣೆ ಮಾಡಿಕೊಳ್ಳುವುದು ಲಾಭದಾಯಕವೇ ಎಂದು ನಿರ್ಧರಿಸುವುದು ಹೇಗೆ

  1. ನಿಮ್ಮ ಕ್ಯಾಶ್ ಹಿಟ್ ರೇಟ್ ಅನ್ನು ಅಳೆಯಿರಿ – ನಿಮ್ಮ ಹೆಚ್ಚಿನ ಕರೆಗಳು ಕ್ಯಾಶ್ ಮಾಡಲಾದ ವಿಷಯಕ್ಕೆ ಸಂಬಂಧಿಸಿದ್ದರೆ, ಕಡಿಮೆ ಪ್ರತಿ-ಟೋಕನ್ ವೆಚ್ಚವು ನೇರವಾಗಿ ಕಡಿಮೆ ಬಿಲ್‌ಗೆ ಪರಿಣಾಮ ಬೀರುತ್ತದೆ.
  2. ನಿಮ್ಮ ಕೆಲಸದ ಸ್ವರೂಪವನ್ನು ಗುರುತಿಸಿ – ಒಂದೇ ಪ್ರಾಂಪ್ಟ್ ಮತ್ತು ಟೂಲ್ ವ್ಯಾಖ್ಯಾನಗಳನ್ನು ಹೊಂದಿರುವ ಪುನರಾವರ್ತಿತ ಏಜೆಂಟ್ ಲೂಪ್‌ಗಳು 45% ರಿಯಾಯಿತಿಗೆ ಅರ್ಹವಾಗಿವೆ. ಬದಲಾಗುತ್ತಾ ಇರುವ ಪ್ರಾಂಪ್ಟ್‌ಗಳೊಂದಿಗೆ ಮಾಡುವ ಒಮ್ಮೆಲೇ ಮಾಡುವ (one-off) ಚಾಟ್‌ಗಳಿಗೆ ಕೇವಲ 25% ರಿಯಾಯಿತಿ ಮಾತ್ರ ಸಿಗುತ್ತದೆ.
  3. ಕೆಲಸದ ಒಟ್ಟು ವೆಚ್ಚವನ್ನು ಹೋಲಿಸಿ – ಕೇವಲ ಪ್ರತಿ-ಟೋಕನ್ ಬೆಲೆಯ ಮೇಲೆ ಮಾತ್ರ ಗಮನ ಕೊಡಬೇಡಿ. ಒಂದು ಕೆಲಸವನ್ನು ಹೆಚ್ಚು ಕರೆಗಳಾಗಿ ವಿಂಗಡಿಸಲು ಒತ್ತಾಯಿಸುವ ಅಗ್ಗದ ಮಾದರಿಯು ಒಟ್ಟಾರೆಯಾಗಿ ಹೆಚ್ಚು ವೆಚ್ಚವಾಗಬಹುದು.
  4. ಸೈಡ್-ಬೈ-ಸೈಡ್ ಪರೀಕ್ಷೆಯನ್ನು ನಡೆಸಿ – ಪ್ರಸ್ತುತ ಮಾದರಿಯನ್ನು ಪ್ರೊಡಕ್ಷನ್‌ನಲ್ಲಿ ಇರಿಸಿದಾಗೆಯೇ, ನಿಮ್ಮ ಟ್ರಾಫಿಕ್‌ನ ಒಂದು ಭಾಗದ ಮೇಲೆ Fable 5.1 ಅನ್ನು ನಿಯೋಜಿಸಿ. ಲೇಟೆನ್ಸಿ (latency), ಟೋಕನ್ ಬಳಕೆ ಮತ್ತು ಔಟ್‌ಪುಟ್ ಗುಣಮಟ್ಟದಲ್ಲಿನ ಯಾವುದೇ ಬದಲಾವಣೆಗಳನ್ನು ಗಮನಿಸಿ.

ನಿಮ್ಮ ಕ್ಯಾಶ್ ಹಿಟ್ ರೇಟ್ ಕಡಿಮೆಯಿದ್ದರೆ ಅಥವಾ ನಿಮ್ಮ ಬಳಕೆಯ ಮಾದರಿಯು ಏಕೈಕ, ವಿಶಿಷ್ಟ ಪ್ರಾಂಪ್ಟ್‌ಗಳಿಂದ ಕೂಡಿದ್ದರೆ, ಆರ್ಥಿಕ ಲಾಭವು ಅಲ್ಪವಾಗಿರಬಹುದು. ಅಂತಹ ಸಂದರ್ಭದಲ್ಲಿ, ಕ್ಯಾಶ್ ಮರುಬಳಕೆಯ ದಕ್ಷತೆಯನ್ನು ಹೆಚ್ಚಿಸಲು ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು ಮರುರಚಿಸುವವರೆಗೆ ಅಸ್ತಿತ್ವದಲ್ಲಿರುವ ಮಾದರಿಯನ್ನೇ ಬಳಸುವುದು ಉತ್ತಮ.

ಸುರಕ್ಷತೆ ಮತ್ತು ಭದ್ರತಾ ಮೇಲ್ದರ್ಜೆಗೇರಿಸುವಿಕೆಗಳು

Anthropic ಮಾದರಿಯ ಸುರಕ್ಷತಾ ಕ್ರಮಗಳನ್ನು (safeguards) ಬಿಗಿಗೊಳಿಸಿದೆ. ಹೊಸ ಆವೃತ್ತಿಯು ಸಾಮಾನ್ಯ ಜೈವಿಕ ಪ್ರಶ್ನೆಗಳನ್ನು (biological queries) ಕಡಿಮೆ ಬಾರಿ ನಿರ್ಬಂಧಿಸುತ್ತದೆ, ಅಂದರೆ ಜೀವವಿಜ್ಞಾನ ಕ್ಷೇತ್ರಗಳಲ್ಲಿನ ಡೆವಲಪರ್‌ಗಳು ಕಡಿಮೆ ತಪ್ಪು ಪಾಸಿಟಿವ್‌ಗಳನ್ನು (false positives) ಎದುರಿಸುತ್ತಾರೆ. ಇದು ಸಾಫ್ಟ್‌ವೇರ್ ದೋಷಗಳನ್ನು (software vulnerabilities) ಗುರುತಿಸುವ ಸಾಮರ್ಥ್ಯವನ್ನೂ ಸೇರಿಸುತ್ತದೆ, ಈ ವೈಶಿಷ್ಟ್ಯವು ಭದ್ರತಾ-ಆಧಾರಿತ ತಂಡಗಳಿಗೆ ಪ್ರತ್ಯೇಕ ಮಾದರಿಯಿಲ್ಲದೆಯೇ ಅಪಾಯಕಾರಿ ಕೋಡ್ ಅನ್ನು ಪತ್ತೆಹಚ್ಚಲು ಸಹಾಯ ಮಾಡುತ್ತದೆ.

ಮಾದರಿಯು ಹೆಚ್ಚಿನ ಅಪಾಯದ ಚಟುವಟಿಕೆಗಳ ಮೇಲಿನ ಕಟ್ಟುನಿಟ್ಟಿನ ಮಿತಿಗಳನ್ನು ಇನ್ನೂ ಗೌರವಿಸುತ್ತದೆ. ಇದು ಪೆನೆಟ್ರೇಶನ್ ಟೆಸ್ಟಿಂಗ್ (penetration testing) ನಡೆಸಲು ಅಥವಾ ಎಕ್ಸ್‌ಪ್ಲೋಯಿಟ್ ಕೋಡ್ (exploit code) ಅನ್ನು ರಚಿಸಲು ಸಾಧ್ಯವಿಲ್ಲ; ಅಂತಹ ಸನ್ನಿವೇಶಗಳು Anthropic ನ Opus ಮಾದರಿಯ ವ್ಯಾಪ್ತಿಗೆ ಸೇರುತ್ತವೆ. ಕಟ್ಟುನಿಟ್ಟಾದ ಡೇಟಾ ನಿರ್ವಹಣೆಯ ಅಗತ್ಯವಿರುವ ಉದ್ಯಮಗಳಿಗಾಗಿ, ಮುಂಬರುವ "Enterprise Frontier Safeguards" ಶರತ್ತುಗಳ ಅಡಿಯಲ್ಲಿ ಡೇಟಾ ಉಳಿಸಿಕೊಳ್ಳುವಿಕೆ ಇರುವುದಿಲ್ಲ (zero data retention), ಇದು ಈ ವರ್ಷದು秋ತು (autumn) ಅವಧಿಯಲ್ಲಿ ಬಿಡುಗಡೆಯಾಗಲಿದೆ. ಅಲ್ಲಿಯವರೆಗೆ, API ಗೆ ಕಳುಹಿಸುವ ಯಾವುದೇ ಡೇಟಾವನ್ನು ಮಾದರಿಯ ಸುಧಾರಣೆಗಾಗಿ ಉಳಿಸಿಕೊಳ್ಳಬಹುದು ಎಂದು ಸಂಸ್ಥೆಗಳು ಭಾವಿಸಬೇಕು.

commitment ಮಾಡುವ ಮೊದಲು ಏನನ್ನು ಪರೀಕ್ಷಿಸಬೇಕು

  • ಕ್ಯಾಶ್ ಕಾರ್ಯಕ್ಷಮತೆ – Fable 5.1 ನ ಬೆಲೆ ನಿಯಮಗಳ ಅಡಿಯಲ್ಲಿ ಎಷ್ಟು ವಿನಂತಿಗಳು ಕ್ಯಾಶ್ ಅನ್ನು ತಲುಪಬಹುದು ಎಂಬುದನ್ನು ಲೆಕ್ಕಹಾಕಲು ನಿಮ್ಮ ಅಸ್ತಿತ್ವದಲ್ಲಿರುವ ಲಾಗ್‌ಗಳನ್ನು ಬಳಸಿ.
  • ಸುರಕ್ಷತಾ ಮಿತಿಗಳು – ಈ ಮೊದಲು ನಿರ್ಬಂಧಕ್ಕೆ ಒಳಗಾಗಿದ್ದ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು (ಉದಾಹರಣೆಗೆ ಮೂಲಭೂತ ಜೀವವಿಜ್ಞಾನದ ಪ್ರಶ್ನೆಗಳು) ಮಾದರಿಗೆ ನೀಡಿ ಮತ್ತು ಅವು ಈಗ ಪಾಸಾಗುತ್ತವೆಯೇ ಎಂದು ಪರಿಶೀಲಿಸಿ.
  • ಬೆಂಚ್‌ಮಾರ್ಕ್ ಸ್ಕೋರ್‌ಗಳು – ಆರಂಭಿಕ ಸಮುದಾಯ ವರದಿಗಳು Terminal-Bench 4.0 ಮತ್ತು Humanity’s Last Exam ನಲ್ಲಿ ಬಲವಾದ ಫಲಿತಾಂಶಗಳನ್ನು ಉಲ್ಲೇಖಿಸಿವೆ. ಕಾರ್ಯಕ್ಷಮತೆಯ ಲಾಭಗಳು ನಿಮ್ಮ ಗುಣಮಟ್ಟದ ನಿರೀಕ್ಷೆಗಳಿಗೆ ಅನುಗುಣವಾಗಿವೆಯೇ ಎಂದು ಖಚಿತಪಡಿಸಿಕೊಳ್ಳಲು ಸಾರ್ವಜನಿಕ ಬೆಂಚ್‌ಮಾರ್ಕ್ ಬಿಡುಗಡೆಗಳನ್ನು ಗಮನಿಸುತ್ತಿರಿ.

ಇಂದು ಇದನ್ನು ಯಾರು ಪಡೆಯಬಹುದು

Fable 5.1 ಅನ್ನು ಕ್ಲೌಡ್ ಪ್ಲಾಟ್‌ಫಾರ್ಮ್‌ಗಳು ಮತ್ತು API ಎಂಡ್‌ಪಾಯಿಂಟ್‌ಗಳ ಮೂಲಕ ಸಾರ್ವಜನಿಕವಾಗಿ ಪಡೆಯಬಹುದು. Anthropic ನ "Mythos 5.1" ಸೈಬರ್ ಸೆಕ್ಯೂರಿಟಿ ಮತ್ತು ಜೀವವಿಜ್ಞಾನ ಸಂಶೋಧನೆಯಲ್ಲಿರುವ ಕೆಲವು ಪಾಲುದಾರರಿಗೆ ಮಾತ್ರ ಸೀಮಿತವಾಗಿದೆ, ಆದ್ದರಿಂದ ವಿಶಾಲವಾದ ಡೆವಲಪರ್ ಸಮುದಾಯವು ಸದ್ಯಕ್ಕೆ Fable 5.1 ನೊಂದಿಗೆ ಕೆಲಸ ಮಾಡಬೇಕಾಗುತ್ತದೆ.

ಅಂತಿಮವಾಗಿ (Bottom line)

ನಿಮ್ಮ ಅಪ್ಲಿಕೇಶನ್‌ಗಳು ಏಜೆಂಟ್ ಲೂಪ್‌ಗಳ ಮೇಲೆ ಹೆಚ್ಚು ಅವಲಂಬಿತವಾಗಿದ್ದರೆ ಅಥವಾ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು ಮರುಬಳಕೆ ಮಾಡುತ್ತಿದ್ದರೆ, ಕ್ಯಾಶ್ಡ್ ಆಪರೇಷನ್‌ಗಳ ಮೇಲೆ ಸಿಗುವ 45% ರಿಯಾಯಿತಿಯು Claude Fable 5.1 ಗೆ ಬದಲಾಗಲು ಒಂದು ಬಲವಾದ ಆರ್ಥಿಕ ಕಾರಣವನ್ನು ನೀಡುತ್ತದೆ. ಹೆಚ್ಚಾಗಿ ವಿಶಿಷ್ಟವಾದ, ಏಕ-ಪ್ರದರ್ಶನ (single-shot) ಪ್ರಶ್ನೆಗಳನ್ನು ನಡೆಸುವ ತಂಡಗಳು ಕೇವಲ 25% ಕಡಿತವನ್ನು ನೋಡುತ್ತವೆ, ಇದು ಬದಲಾವಣೆಯ ಪ್ರಯತ್ನವನ್ನು ಸಮರ್ಥಿಸದಿರಬಹುದು. ಮೇಲ್ದರ್ಜೆಗೇರಿಸಲಾದ ಸುರಕ್ಷತಾ ಕ್ರಮಗಳು ನಿಯಂತ್ರಿತ ಕ್ಷೇತ್ರಗಳಲ್ಲಿ ಮಾದರಿಯ ಬಳಕೆಯನ್ನು ವಿಸ್ತರಿಸುತ್ತವೆ, ಆದರೆ ಇನ್ನೂ ಬಾಕಿ ಇರುವ 'ಜೀರೋ-ರಿಟೆನ್ಷನ್' ಆಯ್ಕೆಯು ಉದ್ಯಮಗಳು ಅಲ್ಪ ಸಂಕ್ರಮಣ ಅವಧಿಗಾಗಿ ಯೋಜಿಸಬೇಕೆಂದು ಸೂಚಿಸುತ್ತದೆ. ಕ್ಯಾಶ್ ಹಿಟ್ ರೇಟ್‌ಗಳನ್ನು ಅಳೆಯಿರಿ, ನಿಯಂತ್ರಿತ ಪೈಲಟ್ ಪರೀಕ್ಷೆಯನ್ನು ನಡೆಸಿ ಮತ್ತು ಪ್ರತಿ-ಕೆಲಸದ ವೆಚ್ಚದ ಹೋಲಿಕೆಯನ್ನು ಅಂತಿಮ ನಿರ್ಧಾರಕ್ಕೆ ಮಾರ್ಗದರ್ಶಕವಾಗಿ ಬಳಸಿ.