Anthropic's Claude 3.7 Sonnetは、AIに拡張された思考をもたらし、さらに新しいコーディングツールをもたらします

人類は本日、Claude 3.7 Sonnetを発表し、AIが迅速な応答と詳細な推論を切り替えることができる新しい「拡張思考」機能を紹介します。同社はまた、自律的なコーディングタスクのモデルを活用する新しいツールであるClaude Codeを発表しました。

Claude 3.7ソネットは、人類によって「ハイブリッド推論モデル」として説明されています。この種の最初のものは、単一のシステムで迅速な回答とより深い分析を組み合わせたものです。より簡単なクエリのために、速度に焦点を当てます。しかし、複雑な問題に直面した場合、AIは拡張された思考モードに関与して、ユーザーに思考プロセスを表示しながら、マルチステップの推論を実行できます。

「人間が迅速な反応と深い反射の両方に単一の脳を使用するのと同じように、私たちは、別のモデルではなく、フロンティアモデルの統合能力であるべきだと考えています」と人類はその発表で述べています。

拡張された思考機能により、Claude 3.7 Sonnetは難しいタスクに取り組むことを大幅に後押しします。ベンチマークテストでは、ソフトウェアエンジニアリングや複雑な現実世界のタスク評価に関するOpenaiのO1やO3-Miniなど、他の「思考」モデルよりも優れていました。ただし、OpenaiのO1は、数学の問題解決や大学院レベルの推論などの分野で、まだクロードを追い出しています。

新しいモデルに加えて、人類はAI駆動のコーディングアシスタントであるClaude Codeを導入しました。限られた調査プレビューを通じて利用可能なClaude Codeを使用すると、開発者はプログラミングタスクをターミナルから直接委任できます。詳細はまばらですが、競合他社のAIツールをますますコーディングすることに対する人類の答えのようです。

Claude 3.7 Sonnetは、Amazon's BedrockやGoogle CloudのVertex AIなど、主要なクラウドプラットフォームを通じて利用できるようになりました。開発者と企業の場合、このモデルは、最大128,000の出力トークンを処理する機能を含む拡張機能を提供します。この容量の増加は、大規模なコード生成と複雑な計画タスクにとって特に価値があります。

また読む:

AIモデルがより洗練されるにつれて、クロードの推論プロセスを見えるようにする人類のアプローチは、AIシステムへの透明性と信頼に影響を与える可能性があります。ただし、この「大声で考えている」機能がユーザーがどのように受信し、大規模な言語モデルの競争力のある状況にどのように影響するかはまだ不明です。

Related Posts