Claude Codeは、プッシュ・トゥ・トーク機能を備えた音声入力を追加します。

Claude Codeで音声入力が利用可能に
Anthropicは、AIコーディングアシスタント「Claude Code」の音声モードの提供を開始しました。現在、約5%のユーザーが利用可能で、今後数週間かけて段階的に拡大される予定です。
音声モードの仕組み
この機能はプッシュトゥトーク方式を採用しています:
- スペースキーを押し続けて音声入力を起動
- プロンプトやコードを話す
- スペースキーを離して録音を停止
音声の文字起こしは、エディタ内の現在のカーソル位置に表示されます。プロンプトの一部を入力し、中間部分を音声で入力し、その後も入力を続けることが可能で、システムは既存のテキストを上書きしません。
アクセスと料金の詳細
- Pro、Max、Team、Enterpriseプランのユーザーが利用可能
- 段階的に展開中(現在は約5%のユーザー)
- 音声モードの利用に追加費用は不要
- 音声文字起こしに使用されるトークンはレート制限にカウントされない
ユーザーはアクセス権を取得すると、ウェルカム画面で通知を受け取ります。利用可能になると、/voiceコマンドで音声モードを切り替えられます。
📖 詳細情報を読む: r/ClaudeAI
👀 See Also

Qwen 3.6-35B-A3B KVキャッシュベンチ:M5 Max上のf16対q8_0対Turbo3対Turbo4、最大1Mコンテキスト
M5 MaxでのTheTomのTurboQuant Metalフォークのベンチマークでは、f16とq8_0は256Kを超えるとOOMになる一方、turbo3は1Mで6.5 tok/sのデコードを達成。コンテキストが長い場合、プリフィルはturbo3、デコードはturbo4が優位。

OpenClawが応答しない理由:ユーザーが懸念を表明
OpenClawユーザーは、応答しないAIコーディングエージェントの問題に直面しています。Redditでの議論は、考えられる原因とユーザーフィードバックに光を当てています。

15のマルチモーダルAIモデルの視覚的推論ベンチマーク結果
AIMultipleは、2つのトラック(チャート理解と視覚的論理)にわたる200の視覚的推論問題で、主要な15のマルチモーダルAIモデルをベンチマークしました。Gemini-3.1-pro-previewとGemini-3-pro-previewが総合結果をリードし、続いてGPT-5.2、Kimi-K2.5、GPT-5.2-proが続きました。

AIによるchardetライブラリの再実装がコピーレフトライセンスの問題を提起
Dan BlanchardはAnthropicのClaudeを使用して、chardet Pythonライブラリをスクラッチから再実装し、ライセンスをLGPLからMITに変更しました。結果として得られたコードは以前のバージョンと1.3%未満の類似性しかなく、AI支援による再実装がコピーレフト保護を侵食するかどうかについて議論を呼んでいます。