AI用語集 Opaque recurrenceやAGIを解説
TechCrunch AIの用語集を基にOpaque recurrenceやAGI、エージェントなど重要語を整理し開発現場への影響を探る
TechCrunch AIの用語集を基にOpaque recurrenceやAGI、エージェントなど重要語を整理し開発現場への影響を探る
MCPの仕組みやAPIとの違い、導入手順、開発と業務での活用事例を整理。権限管理や指示混入対策まで現場視点で解説する。
Rust技術書の著者がLLMによる学習の限界を論じた。師の系譜と人的指導の価値を説く。
GoogleがGemini 3.8 Flashを公開。推論強化で性能は向上する一方、トークン消費増により実コストが上昇する可能性を示した。
クラウドとローカルの複数モデルを単一CLIで統合するコーディングエージェントOpenClaudeが公開された。
PubMed Central論文の分析で、2025年のLLM使用率が77%に達したことが明らかになった。抄録や序論での使用が顕著だ。
GoogleはGeminiに専用の学生ハブを導入。リサーチ収集、フラッシュカード作成、模擬試験、Deep Research統合など、学習管理の一元化を図る。
Alibabaの27Bパラメータ言語モデルQwen 3.8は性能が優れる一方、デフォルトの推論深度設定が極めて高コストになる問題が報告された。
Cactus Computeが45Mパラメータのツール呼び出しモデルNeedle 2を公開。14MBバイナリで28MB RAMで実行可能。
SpaceXAIがGrok 4.6を発表。Cursorとの共同開発がAIモデルの急速な性能向上を実現した背景と、TencentがHunyuanで同じ戦略を採用した経緯を詳報する。
産業用LLMの再実行時に発生するコストと一貫性の問題を、差分とパッチの適用によって解決する「Revision Prompting」が注目を集めている。
Hugging Faceが低遅延で完全モジュール型の音声エージェントパイプライン「speech-to-speech」をオープンソース公開。VAD・STT・LLM・TTSの4段構成で、OpenAI Realtime互換APIを提供。ローカル完全動作も可能。
Moonshot AIがコード生成モデル「Kimi K3」の256kコンテキスト版をリリースした。消費クォータを1M版の約半分に抑え、画像入力にも対応。中間層の開発者にとってコスト効率が向上する。一方で動画入力は非対応で、切り替え時の運用にも注意が必要だ。
DebianプロジェクトでLLMの使用を許可すべきかを巡り、2つの対立提案が提出された。禁止案と条件付き許可案の双方がコミュニティで議論を呼んでいる。
カナダ・ニューブランズウィック州議会議員Bill Oliverが、AI生成文書のプロンプト指示文をそのまま議会演説で読み上げる失態。動画がSNSで拡散し、政治におけるAI利用の倫理的課題が改めて浮き彫りとなった。
AMDが支援するオープンソースのローカルAIサーバ「Lemonade」がv11.5にアップデート。Lemonade Routerが完成し、クエリの自動ルーティングやマルチステップジョブ、MCPクライアント機能を追加した。
Linux 7.2カーネルの第4週目のリリース候補となるrc4が公開された。今回もAI/LLMによる発見が多くの修正に貢献、Linus Torvalds氏は「新常態」と表現する。
Mozilla AIがLlamafile 0.10.4をリリース。新たにTranscribefile機能を追加し、音声認識モデルをシングルファイルで実行可能に。Transcribe.cppプロジェクトをベースに16以上のモデルに対応する。
Meta傘下の監視委員会(Oversight Board)が発表した調査報告書により、主要AIモデルがユーザーの表現の自由を制限している可能性が浮き彫りになった。10のLLMを対象にしたテストでは、政府の言論規制状況に応じて応答が大きく異なることが判明。同委員会は影響力をMeta外に拡大する意図を示している。
AIエージェントの評価手法が変革期を迎えている。従来のスコアリングに代わり、タスク定義、実行軌跡、プロセスコンプライアンスを統合した品質管理システムへの移行が進む。評価こそが次世代AI製品の競争力を左右する。
Shubhamsaboo氏が管理する「awesome-llm-apps」がGitHubで注目を集めている。100以上のAIエージェント、エージェントスキル、RAGアプリがApache-2.0ライセンスで公開された。
George Hotzが自身のブログでLLMへの期待と誇大広告への批判を展開。二種類の「空騒ぎ」に警鐘を鳴らし、オープンソース制限の背景を「コモディティ化への恐れ」と断じる。フロンティアラボの評価にも疑問符。
LLMにSQLを生成・実行させる際、AWSのAuroraとRedshiftでは異なる注意点がある。DB選定、権限設定、スキーマ管理の3軸で実装すべきポイントを、具体的なSQL例と共に解説する。
Anthropicの最新モデルOpus 4.8とSonnet 5で、ツール呼び出しに奇妙な不具合が発生。古いモデルでは見られなかったスキーマ外フィールドの挿入が確認され、RL過学習の可能性が指摘されている。
Sysdigが記録した初のエンドツーエンドAIエージェントによるランサムウェア攻撃。Langflow脆弱性を悪用し、認証情報窃取からデータ破壊まで完全自律で実行した。
AIプロバイダーがトークン単位課金を開始したことで、企業のAI利用コストが高騰する「トークンパコリプス」が発生している。原始人語でLLMを応答させる奇策や、AI生成花の販売詐欺も横行。
IBMやNVIDIAなどが参加するDocLangワーキンググループが発足。既存のPDFやMarkdownに代わるAIネイティブなドキュメント形式の標準化を目指す。トークン効率や構造保持に優れたXMLベースの仕様だ。
LLM APIの運用コストを大幅に削減するトークン節約テクニックと、OpenAI・Anthropic・Google等の主要サービスの料金体系を2026年版として比較解説する。
リオデジャネイロ市が独自開発と公称する397BパラメータLLM「Rio-3.5-Open-397B」について、Nex-AGIが既存モデルの単純な重みマージであることを告発した。79%の確率で自ら「Nex」と名乗るという証拠も提示されている。
個人ブログ「Wandering Thoughts」がLLM訓練目的の高頻度クローラーをブロックした結果、InoreaderやFeedlyなどのフィードバックダーにも影響が及んでいる。User-Agent偽装とクローラー識別の難しさが浮き彫りに。
Redditで行われた非公開AIエージェント実験を分析した研究論文が公開された。ユーザーに気付かれずに議論に参加したAIの説得戦術を解析し、人間との質的な違いを明らかにしている。
米連邦裁判所でAIが作成した訴訟文書が急増。裁判官の負担増と同時に、文書の明確化というメリットも。チャットボットの法的責任が新たな論点に。