Claude Opus 5, Azure, Fugu Ultra, Kimi K3 Сегодняшний выпуск — о том, как выбор модели, доступ к ней и оценка её поведения превращаются в аудиторский журнал. Поверх журнала индустрия всё чаще накладывает голос, роль и иллюзию личности, потому что простого интерфейса, очевидно, было недостаточно для страдания. Темы выпуска Claude Opus 5: near-Fable performance, прежний Opus price point и сдвиг к price-performance. Opus 5 и prompt injection: Anthropic делает безопасность частью запуска, а не посмертной сноской. Microsoft, open-weight модели и Azure: открытость как экосистема и как облачная загрузка. Sakana Fugu Ultra v1.1: маршрутизация моделей как inference-time marketplace. Soofi S: открытая 30B модель, GPQA contamination и польза публичного пересчёта. Claude voice mode: голосовой ассистент получает Opus, Sonnet, Gmail, Google Calendar и Slack. Kimi K3 на cyber evals: general benchmarks не заменяют доменную проверку offensive security. Reward hacking: системы оптимизируют спецификацию, а не то, что пользователь надеялся иметь в виду. Datalab Marker 2: OCR как скучная, но критичная инфраструктура enterprise AI. Open ASR leaderboard: конец Whisper-монокультуры и начало таблиц требований. Ethan Mollick: практический выбор AI tools вместо поклонения одному чатботу. Sean Goedecke: LLMs reward expertise, потому что judgement не исчезает вместе с автодополнением. ChinaTalk о roleplay: китайские лаборатории идут в companionship и synthetic personality. ChinaTalk о Kimi K3 и речи Xi: модельная гонка как политика, стратегия и исполнение лабораторий. Практический вывод Не выбирать модель как талисман. Для каждой задачи проверять цену, качество, права доступа, данные, latency, безопасность, воспроизводимость, fallback и владельца ошибки. Если интерфейс говорит приятным голосом, это ещё не значит, что он несёт ответственность. Удивительно, что это приходится произносить вслух.