Metaも新AIモデル「Muse Spark 1.3」 1カ月で大幅強化し「Fable 5に匹敵」
予習
この記事のキーワード — タップで意味×4
匹敵
ひってき
to be a match for; to rival; to equal; to compare with; to be equivalent to
N1×8
向上
こうじょう
elevation; rise; improvement; advancement; progress
N1×6
性能
せいのう
ability; performance; efficiency
N2×4
学習
がくしゅう
study; learning; tutorial
×4
生成
せいせい
creation; generation; formation; derivation
Metaは2日(米国時間)、エージェントタスクやコーディングタスクのパフォーマンスを向上した最新モデル「Muse Spark 1.3」を提供開始した。この数カ月にわたる「Muse Code」や「Meta Model API」の幅広い導入から得た知見を活かし、大幅に改良。一部のベンチマークでAnthropicの「Fable 5」に匹敵する性能を見せている。
8月の「Muse Spark 1.2」公開から約1カ月で新モデルを公開。Muse Spark 1.3は、コーディングエージェントの「Muse Code」と「Meta Model API」で2日から提供開始。また、追加の安全性テストが完了次第、「最大推論モード」も利用可能とする。
Muse Spark 1.3は、単一の長いスレッド内で複数のワークフローを同時に処理し、長期にわたる作業を持続的に遂行できるよう設計された。高い目標が与えられても、ツールを使用し、独自のコンテキストを生成し、計画の欠落を先回りして修正。学習した内容を追跡して最終的な成果物を生成する。多様なエージェント環境に対応できるよう、多くのハーネスを用いてモデルを学習させている。
また、ユーザーとの"協働"を重視した設計とし、プロンプトが曖昧な場合は、確認のための質問を行ない、行き詰まった際にはユーザーに助けを求め、重大なアクションを実行する前に確認を行なう。タスクの進捗・更新情報を随時提供し、バックグラウンドで静かに動作するかなど、ユーザーの好みにあわせて使えるという。これらにより、複雑で長文の指示をより確実に実行できるようにした。マルチタスク性能も向上している。
コーディングタスクにおいても、使いやすさを向上。Muse Spark 1.2と比較して、不要なターンが少なくなり、冗長性も低減され、全体としてより洗練されたコーディングスタイルとなったという。Metaのエンジニアによる比較では、ツール呼び出しが約20%減少し、トークン数が約25%減少するなど、効率性が向上している。
コーディングベンチマークの「DeepSWE v1.1」は75.4で、Muse Spark 1.2の55、GPT-5.6 Solの73、Opus 5の74を越えている。
今後、より大規模なモデルの導入や、Muse Sparkのオープンウェイトのリリースなどの強化も予定している。
Meta Superintelligence LabsのAlexandr Wang氏は、高い性能を安価に実現するMuse Spark 1.3についてXで紹介しながら、Artificial Analysisのベンチマークに触れ、「Claude Code+ Opus 5やClaude Code + Fable 5に匹敵する」と言及。また、ベンチマーク結果に対し、「Geminiって誰?(gemini who? )」とも投稿している。
1/ today we’re releasing muse spark 1.3—available in muse code & the meta model api.
this is our most capable model yet—frontier performance almost too cheap to meter. much stronger at agentic and coding with better usability. we think users will really notice the jump. pic.twitter.com/RW6n5NQsBw
— Alexandr Wang (@alexandr_wang) September 2, 2026
muse spark 1.3 + muse code evals competitively with Claude code + opus 5 and Claude code + fable 5 https://t.co/rfYfjfQLJO
— Alexandr Wang (@alexandr_wang) September 3, 2026
i really hate to say it, but…
gemini who? 🏎️💨 https://t.co/Umv4CVqgre
— Alexandr Wang (@alexandr_wang) September 2, 2026
Metaは2日(米国時間)、エージェントタスクやコーディングタスクのパフォーマンスを向上した最新モデル「Muse Spark 1.3」を提供開始した。この数カ月にわたる「Muse Code」や「Meta Model API」の幅広い導入から得た知見を活かし、大幅に改良。一部のベンチマークでAnthropicの「Fable 5」に匹敵する性能を見せている。 8月の「Muse Spark 1.2」公開から約1カ月で新モデルを公開。Muse Spark 1.3は、コーディングエージェントの「Muse Code」と「Meta Model API」で2日から提供開始。また、追加の安全性テストが完了次第、「最大推論モード」も利用可能とする。 Muse Spark 1.3は、単一の長いスレッド内で複数のワークフローを同時に処理し、長期にわたる作業を持続的に遂行できるよう設計された。高い目標が与えられても、ツールを使用し、独自のコンテキストを生成し、計画の欠落を先回りして修正。学習した内容を追跡して最終的な成果物を生成する。多様なエージェント環境に対応できるよう、多くのハーネスを用いてモデルを学習させている。 また、ユーザーとの"協働"を重視した設計とし、プロンプトが曖昧な場合は、確認のための質問を行ない、行き詰まった際にはユーザーに助けを求め、重大なアクションを実行する前に確認を行なう。タスクの進捗・更新情報を随時提供し、バックグラウンドで静かに動作するかなど、ユーザーの好みにあわせて使えるという。これらにより、複雑で長文の指示をより確実に実行できるようにした。マルチタスク性能も向上している。 コーディングタスクにおいても、使いやすさを向上。Muse Spark 1.2と比較して、不要なターンが少なくなり、冗長性も低減され、全体としてより洗練されたコーディングスタイルとなったという。Metaのエンジニアによる比較では、ツール呼び出しが約20%減少し、トークン数が約25%減少するなど、効率性が向上している。 コーディングベンチマークの「DeepSWE v1.1」は75.4で、Muse Spark 1.2の55、GPT-5.6 Solの73、Opus 5の74を越えている。 今後、より大規模なモデルの導入や、Muse Sparkのオープンウェイトのリリースなどの強化も予定している。 Meta Superintelligence LabsのAlexandr Wang氏は、高い性能を安価に実現するMuse Spark 1.3についてXで紹介しながら、Artificial Analysisのベンチマークに触れ、「Claude Code+ Opus 5やClaude Code + Fable 5に匹敵する」と言及。また、ベンチマーク結果に対し、「Geminiって誰?(gemini who? )」とも投稿している。 1/ today we’re releasing muse spark 1.3—available in muse code & the meta model api. this is our most capable model yet—frontier performance almost too cheap to meter. much stronger at agentic and coding with better usability. we think users will really notice the jump. pic.twitter.com/RW6n5NQsBw — Alexandr Wang (@alexandr_wang) September 2, 2026 muse spark 1.3 + muse code evals competitively with Claude code + opus 5 and Claude code + fable 5 https://t.co/rfYfjfQLJO — Alexandr Wang (@alexandr_wang) September 3, 2026 i really hate to say it, but… gemini who? 🏎️💨 https://t.co/Umv4CVqgre — Alexandr Wang (@alexandr_wang) September 2, 2026
Metaは2日(米国時間)、エージェントタスクやコーディングタスクのパフォーマンスを向上した最新モデル「Muse Spark 1.3」を提供開始した。この数カ月にわたる「Muse Code」や「Meta Model API」の幅広い導入から得た知見を活かし、大幅に改良。一部のベンチマークでAnthropicの「Fable 5」に匹敵する性能を見せている。 8月の「Muse Spark 1.2」公開から約1カ月で新モデルを公開。Muse Spark 1.3は、コーディングエージェントの「Muse Code」と「Meta Model API」で2日から提供開始。また、追加の安全性テストが完了次第、「最大推論モード」も利用可能とする。 Muse Spark 1.3は、単一の長いスレッド内で複数のワークフローを同時に処理し、長期にわたる作業を持続的に遂行できるよう設計された。高い目標が与えられても、ツールを使用し、独自のコンテキストを生成し、計画の欠落を先回りして修正。学習した内容を追跡して最終的な成果物を生成する。多様なエージェント環境に対応できるよう、多くのハーネスを用いてモデルを学習させている。 また、ユーザーとの"協働"を重視した設計とし、プロンプトが曖昧な場合は、確認のための質問を行ない、行き詰まった際にはユーザーに助けを求め、重大なアクションを実行する前に確認を行なう。タスクの進捗・更新情報を随時提供し、バックグラウンドで静かに動作するかなど、ユーザーの好みにあわせて使えるという。これらにより、複雑で長文の指示をより確実に実行できるようにした。マルチタスク性能も向上している。 コーディングタスクにおいても、使いやすさを向上。Muse Spark 1.2と比較して、不要なターンが少なくなり、冗長性も低減され、全体としてより洗練されたコーディングスタイルとなったという。Metaのエンジニアによる比較では、ツール呼び出しが約20%減少し、トークン数が約25%減少するなど、効率性が向上している。 コーディングベンチマークの「DeepSWE v1.1」は75.4で、Muse Spark 1.2の55、GPT-5.6 Solの73、Opus 5の74を越えている。 今後、より大規模なモデルの導入や、Muse Sparkのオープンウェイトのリリースなどの強化も予定している。 Meta Superintelligence LabsのAlexandr Wang氏は、高い性能を安価に実現するMuse Spark 1.3についてXで紹介しながら、Artificial Analysisのベンチマークに触れ、「Claude Code+ Opus 5やClaude Code + Fable 5に匹敵する」と言及。また、ベンチマーク結果に対し、「Geminiって誰?(gemini who? )」とも投稿している。 1/ today we’re releasing muse spark 1.3—available in muse code & the meta model api. this is our most capable model yet—frontier performance almost too cheap to meter. much stronger at agentic and coding with better usability. we think users will really notice the jump. pic.twitter.com/RW6n5NQsBw — Alexandr Wang (@alexandr_wang) September 2, 2026 muse spark 1.3 + muse code evals competitively with Claude code + opus 5 and Claude code + fable 5 https://t.co/rfYfjfQLJO — Alexandr Wang (@alexandr_wang) September 3, 2026 i really hate to say it, but… gemini who? 🏎️💨 https://t.co/Umv4CVqgre — Alexandr Wang (@alexandr_wang) September 2, 2026
この記事の単語 (93)
×8
向上
こうじょう
elevation; rise; improvement; advancement; progress
×6
提供
ていきょう
1. offer; tender; providing; supplying; making available; donating (blood, organs, etc.) 2. sponsoring (a TV program)
×6
性能
せいのう
ability; performance; efficiency
×4
開始
かいし
start; commencement; beginning; initiation
×4
導入
どうにゅう
introduction; bringing in; leading in; installation
×4
匹敵
ひってき
to be a match for; to rival; to equal; to compare with; to be equivalent to
×4
公開
こうかい
opening to the public; making available to the public; putting on display; exhibiting; showing (play, movie, etc.); holding (interview, etc.); open; public
×4
設計
せっけい
plan; design; layout
×4
生成
せいせい
creation; generation; formation; derivation
×4
学習
がくしゅう
study; learning; tutorial
×4
確認
かくにん
confirmation; verification; validation; review; check; affirmation; identification
×4
実行
じっこう
execution (e.g. of a plan); carrying out; practice; action; implementation; fulfillment; realization
×4
比較
ひかく
comparison
×4
減少
げんしょう
decrease; reduction; decline
×2
米国
べいこく
(United States of) America; USA; US
×2
時間
じかん
1. time 2. hour
×2
最新
さいしん
latest; newest; late-breaking (news)
×2
数カ月
すうかげつ
several months
×2
幅広い
はばひろい
extensive; wide; broad
×2
知見
ちけん
expertise; experience; knowledge
×2
生かす
いかす
1. to make (the best) use of; to put to good use; to leverage (skills, attributes, experience, etc.); to capitalise on (experience, etc.) 2. to let live; to keep alive
×2
大幅
おおはば
1. big; large; drastic; substantial 2. full-width cloth (approx. 72 cm wide for traditional Japanese clothing; approx. 140 cm wide for Western clothing)
×2
改良
かいりょう
improvement; reform
×2
一部
いちぶ
1. one part; one portion; one section; some 2. one copy (e.g. of a document)
×2
箇月
かげつ
months (period of)
×2
追加
ついか
addition; supplement; appending; appendix
×2
安全性
あんぜんせい
safety; security
×2
完了
かんりょう
1. completion; conclusion 2. perfect (tense, form, aspect)
×2
次第
しだい
1. depending on 2. as soon as; immediately after; upon
×2
最大
さいだい
biggest; greatest; largest; maximum
×2
推論
すいろん
inference; deduction; induction; reasoning
×2
利用可能
りようかのう
available; usable (e.g. bandwidth)
×2
単一
たんいつ
single; simple; sole; individual; unitary
×2
複数
ふくすう
plural; multiple; several
×2
同時
どうじ
simultaneous; concurrent; same time; synchronous; together
×2
処理
しょり
processing; dealing with; treatment; disposition; disposal
×2
長期
ちょうき
long-term
×2
作業
さぎょう
work; operation; manufacturing; fatigue duty
×2
持続的
じぞくてき
continuous; sustained; sustainable; durable; persistent
×2
遂行
すいこう
accomplishment; execution
×2
目標
もくひょう
1. goal; target; aim; objective 2. mark; sign; landmark
×2
与える
あたえる
1. to give (esp. to someone of lower status); to bestow; to grant; to confer; to present; to award 2. to provide; to afford; to offer; to supply
×2
使用
しよう
use; application; employment; utilization; utilisation
×2
独自
どくじ
1. original; unique; distinctive; characteristic; peculiar 2. independent; one's own; personal
×2
欠落
けつらく
missing; lacking
×2
先回り
さきまわり
going on ahead; forestalling; anticipating; arrival before another
×2
修正
しゅうせい
amendment; correction; revision; modification; alteration; retouching; update; fix
×2
内容
ないよう
contents; content; substance; matter; detail; import
×2
追跡
ついせき
1. chase; pursuit; tracking; stalking 2. following up; tracing
×2
最終的
さいしゅうてき
final; eventual; ultimate
×2
成果物
せいかぶつ
deliverables
×2
多様
たよう
diverse; varied
×2
環境
かんきょう
environment; circumstance
×2
対応
たいおう
1. correspondence (to); equivalence 2. suitability; coordination; matching; being appropriate (for)
×2
用いる
もちいる
to use; to make use of; to utilize; to utilise
×2
協働
きょうどう
cooperation
×2
重視
じゅうし
regarding as important; attaching importance to; taking a serious view of; putting emphasis on
×2
曖昧
あいまい
1. vague; ambiguous; unclear 2. shady; disreputable
×2
行き詰まる
いきづまる
to come to a dead end; to come to a standstill; to reach a deadlock; to reach an impasse; to reach a stalemate
×2
際
さい
on the occasion of; circumstances; juncture
×2
助け
たすけ
assistance; help; aid; support; reinforcement
×2
求める
もとめる
1. to want; to wish for 2. to request; to demand; to require; to ask for
×2
重大
じゅうだい
serious; important; significant; grave; weighty
×2
進捗
しんちょく
progress; being under way
×2
更新
こうしん
renewal; update; innovation; improvement
×2
情報
じょうほう
1. information; news; intelligence; advices 2. information; data contained in characters, signals, code, etc.
×2
随時
ずいじ
1. whenever necessary; as needed; as required; as occasion demands 2. at any time; at all times
×2
動作
どうさ
action; movements; motions; bearing; behaviour; behavior; execution; actuation; operation; manners
×2
好み
このみ
liking; taste; choice
×2
合わせる
あわせる
1. to match (rhythm, speed, etc.) 2. to join together; to unite; to combine; to add up
×2
長文
ちょうぶん
1. long sentence 2. long piece of writing (e.g. passage, letter, article, telegram)
×2
指示
しじ
1. indication; denotation; designation 2. instructions; directions
×2
確実
かくじつ
certain; sure; definite; reliable; sound; solid; safe; secure
×2
不要
ふよう
unnecessary; unneeded
×2
少ない
すくない
few; a little; scarce; insufficient; seldom
×2
冗長性
じょうちょうせい
redundancy
×2
低減
ていげん
decrease; reduction; fall; depreciation; mitigation
×2
全体
ぜんたい
whole; entirety; whatever (is the matter)
×2
洗練
せんれん
polish; refinement
×2
呼び出し
よびだし
1. call; summons; paging; curtain call 2. usher who calls the names of wrestlers, sweeps the ring, etc.
×2
数
すう
1. several; a number of 2. quantity; amount
×2
効率性
こうりつせい
efficiency
×2
越える
こえる
1. to cross over; to cross; to pass through; to pass over (out of); to go beyond; to go past 2. to exceed; to surpass; to be more (than)
×2
今後
こんご
from now on; hereafter
×2
大規模
だいきぼ
large-scale
×2
強化
きょうか
strengthening; intensifying; reinforcement; enhancement; solidification
×2
安価
あんか
1. low-priced; cheap; inexpensive 2. shallow (e.g. sympathy); superficial; cheap (e.g. government)
×2
実現
じつげん
implementation (e.g. of a system); materialization; materialisation; realization; realisation; actualization; actualisation
×2
触れる
ふれる
1. to touch; to feel 2. to touch (with)
×2
言及
げんきゅう
reference; allusion
×2
結果
けっか
1. result; consequence; outcome; effect 2. coming to fruition; bearing fruit
×2
って
1. you said; he said; she said; they said 2. if ... then
×2
投稿
とうこう
contribution (to a newspaper, magazine, etc.); submission; post (on a blog, social media, etc.)