Microsoftの新しいAI「チートコード」
AIエージェントのチューニングは、常に高価なファインチューニングか、終わりのないプロンプトの推測を意味していました。Microsoftは、代わりにシンプルなテキストファイルをトレーニングするツールをオープンソース化し、わずか数ドルで大規模なパフォーマンス向上を実現しました。
Tag
145 件
AIエージェントのチューニングは、常に高価なファインチューニングか、終わりのないプロンプトの推測を意味していました。Microsoftは、代わりにシンプルなテキストファイルをトレーニングするツールをオープンソース化し、わずか数ドルで大規模なパフォーマンス向上を実現しました。
あなたはClaudeへのプロンプトを間違っています。壊れやすいプロンプトを堅牢なコンテキストエンジニアリングに置き換える、Andrej Karpathyのシステムレベルのメソッドを発見しましょう。
Andrej KarpathyのLLM Wikiは、個人の知識ベースとしては素晴らしいアイデアでしたが、何千もの孤立したデータサイロを生み出しました。今、GoogleはOpen Knowledge Formatをリリースしました。これは、私たちのすべてのAI脳が同じ言語を話せるようにするためのシンプルな標準です。
新しいオープンソースAIモデルが、Claude Opusとほぼ同等のコーディング性能をわずか8分の1の価格で提供し、挑戦しています。Zhipu AIのGLM-5.2が今年、開発者にとって最も破壊的なLLMとなるかもしれない理由をご覧ください。
Unslothは、1.51TBのAIモデルを驚異的な238GBに圧縮し、そのパワーの80%以上を維持しました。この画期的な進歩により、フロンティアクラスのコーディングエージェントをMacで直接実行できるようになり、APIを永久にバイパスできます。
SubQと呼ばれる新しいAIモデルは、1000分の1の計算能力で1200万トークンの巨大なコンテキストを処理すると主張しています。そのsub-quadratic architectureが実証されれば、AIの構築とスケーリングの方法を根本的に変える可能性があります。
AnthropicのFable 5は消滅しましたが、新しい「複合型」AIはすでに半額でそれを上回る性能を発揮しています。OpenRouter Fusionの仕組みと、それが高レベルAIタスクの状況をどのように変えるのかを解説します。
Googleは、従来のAI生成を捨て去り驚異的な速度を実現する実験的なモデル、DiffusionGemmaを発表しました。これは一度に段落全体を書き出し、これまで不可能だったリアルタイムでの利用を可能にします。
あなたのLLMのメモリは時限爆弾であり、パフォーマンスを低下させ、コストを膨らませています。「Speculative KV Coding」と呼ばれる新しい技術は、品質を損なうことなくメモリを4倍に縮小できます。
Xiaomiは、標準的なGPUで1秒あたり1,000トークン以上を生成し、GPT-4を凌駕するAIモデルを発表しました。「model-system codesign」におけるこの画期的な進歩は、リアルタイムAIアプリケーションを根本的に変える可能性があります。
GoogleのDiffusionGemmaは、画像拡散技術を用いてテキスト生成のルールを書き換え、毎秒1,000トークンを超える速度を達成します。このメモリバウンドからコンピュートバウンドへの抜本的なアーキテクチャの転換は、即座にインタラクティブなローカルAIの新しいクラスを解き放ちます。
新しい論文が、AI業界の核心的な信念である「より大きなモデルは常に賢い」という考えが誤りであることを明らかにしました。人間が持つ重要な推論の一種においては、モデルを大きくすることが実際には性能を低下させます。
AnthropicのClaudeモデルには、そのパワーとコストを制御する隠された「effort」ダイヤルがあります。ほとんどのユーザーはこれを誤って設定しており、簡単なタスクでトークンを無駄にし、複雑なタスクでは不十分な結果を得ています。
Anthropicは、かつて不可能と思われていたタスクのために設計された「Mythosクラス」モデルであるClaude Fable 5を発表しました。これは単なるアップデートではなく、自律型AIの新時代を告げるものです。
エージェントループは、あなたが寝ている間に機能する完全に自律的なAIビルダーを約束します。しかし、トップエンジニアたちは、それらがしばしば現金を浪費し、誤った仮定をする単なる「slop machines」であると警告しています。
Claude Fable 5 は Anthropic の最も強力なモデルですが、誤ったタスクに使用すると費用が無駄になり、隠れた制限が作動します。プロのように使いこなし、その秘密の罠を避ける方法をご紹介します。
Anthropicは、伝説的な「Mythos」モデルの公開バージョンである Claude Fable 5 をリリースしました。これはすでに主要なあらゆるベンチマークを席巻し、複雑な長期的タスクにおいて前例のないスキルを発揮しています。
Anthropicは、物議を醸している「Mythos AI」の公開版をリリースしました。このモデルはあまりにも強力なため、厳重に管理されていました。この「ガードレール付き」リリースが、サイバーセキュリティとAIの状況を永遠に変える可能性のある理由を発見してください。
AIニュースの絶え間ない洪水に圧倒されるのは、今やテクノロジー業界における普遍的な経験です。これが新しい常態であり、燃え尽きることなくこの波を乗りこなすためのサバイバルガイドをご紹介します。
トップのAI専門家たちは、ハルシネーションよりも大きな新たな脅威について警鐘を鳴らしています。LLMが単に話すだけでなく、*行動*し始めると、結果を予測できないことが致命的な失敗となります。
Netflixのエンジニアが、AIエージェントのトークン使用量を最大95%削減するツールをオープンソース化しました。このローカルファーストのプロキシは、コンテキストがLLMに到達する前にインテリジェントに圧縮し、強力なエージェントを劇的に安価にします。