@shinkai_ / 13日前 「LLMじゃないAI」が来た! TypeSafe AI「Jev」はなぜ文字列生成を捨てたのか TypeSafe AIがLLMではないSystem One Modelsを発表、第一弾はJev並列サンプラーと型付き構造化出力、RLCDという独自の強化学習手法を採用出力コストが無料で応答時間が数十〜数百倍速いが、自由な文章生成は不可 #生成AI・LLM#AIエージェント#機械学習
@Phung Dinh Son / 13日前 Markdownは新しい攻撃ベクトルになった — AIエージェント時代の間接プロンプトインジェクション入門 プロンプトインジェクションはLLMの構造的制約であり、間接インジェクションが特に危険プロンプトインジェクションの2種類(直接・間接)、Lethal Trifecta(プライベートデータ・信頼不能コンテンツ・外部通信の3要素)プライベートデータへのアクセスを最小限にし、信頼不能コンテンツを厳しくチェックし、外部通信を制限する対策が有効 #AIエージェント#機械学習#セキュリティ
@エイトハンドレッド TECH BLOG / 13日前 【AIに任せて失敗した③】「見れば分かる」を自動判定させようとして、設計から作り直した Excel帳票の項目種別を罫線や塗りで自動判定しようと試みたが失敗した罫線の太さ・線種・セルの塗りを基準に判定したが、データに一貫したルールがなかった自動生成結果を人が確定させる形に変更することで作業時間を当初の想定に収めた #AIエージェント#バックエンド#DevOps・CI/CD
@GitHub OSS / 13日前 alphaXiv/OpenResearch OpenResearchが研究エージェントと自動研究のためのローカルファーストワークスペースを提供するClaude CodeやOpenCodeなどのモデルを研究エージェントに変換し、gitワークツリーで独立したセッションを実行できる、ローカルSQLiteストアとCLIコマンドを備えるプロジェクトや実行はローカルに保持され、コードの公開は必要なく、使用状況の分析はオプトアウト可能で個人情報は含まれない #AIエージェント#DevOps・CI/CD#OSS
@GitHub OSS / 13日前 BrowserSkill BrowserSkillはAIエージェントにブラウザ操作を安全に実行させるためのツールを提供するbsk CLIとブラウザ拡張機能で構成され、タブの貸し出しと人間の介入をサポートするタブの貸し出しは明示的で、タスク終了後に返却する必要があり、他のブラウザ操作に干渉しない #AIエージェント#DevOps・CI/CD#フロントエンド
@GitHub OSS / 13日前 Agent Skills:AIコーディングエージェントの生産性スキルセット AIエージェント向けの25のスキルセットが公開され、開発プロセスを構造化する/specや/testなどの9つのスラッシュコマンド、テスト駆動開発やセキュリティチェックリストが含まれる/buildで自動化されたプロセスを実行する際、テストは必須で失敗時に停止する #AIエージェント#DevOps・CI/CD#セキュリティ
@Tamura Satoru / 13日前 AIペルソナはユーザーの代わりになるのか? 論文3本から探る、できること・できないこと LLMはUIの問題候補を挙げたり、人間と重なる定性的な論点を出したりできるDuan et al.はGPT-4でUIガイドライン違反を検出、Hwang and KangはAIペルソナで定性的テーマを抽出、Kuric et al.はGPTのクリック行動を実ユーザーと比較LLMの出力は実ユーザーの反応そのものではなく、仮説や予測として扱う必要がある #生成AI・LLM#AIエージェント#機械学習
@yushibats / 13日前 話題のJevとは?文章を書かずに判断だけを返すAIモデルをざっくり解説 Jevは文章を生成せず、選択肢ごとの確率と確信度を返すAIモデル選択肢から1つ選ぶChoice、段階評価のScore、Yes/NoのNoulの3種類の問いに対応。確信度で処理を分岐可能確信度が0.9以上なら自動処理、0.5以上なら人間確認、それ以下なら人が振り分け。計算や日付比較は不得意と明記 #生成AI・LLM#AIエージェント#機械学習
@hacchi_no_donburi / 13日前 AWS AI-DLC Unicorn Gymに参加して感じた、AI時代に開発者の仕事はどう変わるのか AWS AI-DLCではAIが判断点を提示し、人が意思決定と検証を行うAI-DLC Workflows v2は決定論的なエンジンで進行を管理し、AIが実行を担当する開発者は判断の背景やリスクを次の工程に引き継ぐ必要がある #AIエージェント#DevOps・CI/CD#アーキテクチャ
@おうどんちゅる美 / 13日前 Grok Botで遊んでみた。|AI|AIエージェント|Grok Bot|Grok| Grok Botはスレッドの概念を排除し、1つの長い会話とBot分担で整理する設計スレッドではなく1対1の会話+グループチャットで話題を分ける、Botの役割分担とグループチャットの使い分けスレッド運用に慣れているユーザーは違和感を感じる可能性がある #AIエージェント#生成AI・LLM
@aidasquid / 13日前 2026年版 LLM勢力図&モデルまとめ 2026年現在のLLM勢力図と主要モデルの特徴がまとめられているChatGPT、Claude、Gemini、DeepSeek、Qwen、Moonshot、Liquid AI、xLSTM、Jevなどのモデルと、Transformerの代替アーキテクチャが紹介されているLLMの性能やアーキテクチャの選択が開発戦略に直接影響するため、モデルの特徴を理解することが重要 #生成AI・LLM#AIエージェント#機械学習
@Yasuhito Morimoto / 13日前 国内AIエージェント動向(2026/9/18号) 国内のAIエージェント導入が業務実装、ナレッジ整備、運用定着へと移行している住友電装の監査AI、介入AI、レビューAI、アビームとNotionのAgent OS、TinyFishの自律Web操作AIエージェント導入の競争軸がモデル性能から業務実装、ナレッジ整備、運用定着、効果検証へ移行している #AIエージェント#機械学習#インフラ
@ryo-ume / 13日前 AIが読んでいるもの、書いているもの ― トークンの話 AIエージェントのトークン使用量を節約する方法が説明されているトークンはAIが文章を処理する単位で、入力と出力の両方に影響する。読ませすぎない、考えさせすぎない、出力させすぎない、やり直させないの4つのポイントが挙げられているAIに必要な情報に集中させることが重要で、不要な情報や処理を減らすことでトークンを節約できる #AIエージェント#生成AI・LLM
@watany / 13日前 Jevでハーネスエンジニアリング JevはSystem One Modelとして、LLMと異なる高速で低コストな判断APIとして登場System One Model、inputがGPT 5.6 Lunaより約八割引きの安さ、outputは無料、汎用分類機としての用途Vercel版のAPIは無料ユーザでは使えないため、ProプランにアップグレードするかAI Creditにチャージする必要がある #生成AI・LLM#AIエージェント#クラウド
@Gemini - Google の AI / 13日前 「#AI とできたこと」投稿コンテスト開催! Gemini と一緒に、次の「できた!」へ踏み出そう Geminiとnoteのコラボ投稿コンテストが開催されるAIを使った日常の「できた」体験をエッセイやマンガで投稿投稿には#AIとできたことと#Geminiのハッシュタグをつけること #生成AI・LLM#AIエージェント#バイブコーディング
@Naiʻa / 13日前 ASI( 超人工知能 )時代の個人の「表現」はどうなるのか - Geminiとの対話 ASI時代の表現は、自己意識と世界との共鳴体として進化する表現・共有・反応・接続の一体化とシャボン玉の融合、透明度の高い自己意識の必要性自己の感情や身体感覚を明確に受け取れる力が、意識の海での自己認識を支える #AIエージェント#生成AI・LLM#バイブコーディング
@坂本 / 13日前 今話題のJevを試したら最高だった JevにAIエージェントの操作承認を置き換えることで、精度を維持しながらコストと速度を改善Jevは構造化された判断を返すモデルで、choice形式でallowとescalateの二択を返す。従来モデルはgpt-5.6-lunaを使用Jevのコストは従来の約1/10、判定時間は約1/13で、正解率は100%。プライバシーポリシーと利用規約の確認が必要 #AIエージェント#生成AI・LLM
@Tim De Chant / 14日前 Khosla-backed Mazama Energy just raised $135M to drill deeper into super-hot-rock geothermal Mazama Energyが1億3500万ドルを調達し、超高温岩に水平井を掘る技術を開発中超高温岩に15,000フィートまで掘り進め、750度の高温で超臨界流体を生成する技術と、15メガワットの発電を1井で可能にする技術Oregonのサイトで10ギガワットの発電が可能で、2030年までに200メガワットを発電する予定 #クラウド#インフラ#AIエージェント
@ryu-ki / 14日前 【Jev】文章を返さない判断モデル Jev とは?〜システム運用での活用方法についても想像してみる〜 Jevは文章を生成せず、判断と確率を返すモデルであるChoice型は選択肢と確率分布、Score型は点数、Noul型は0〜1の確率を返す確信度のしきい値を設定して自動処理と人間の判断を分ける設計が必要 #生成AI・LLM#AIエージェント
@suwa_nobu / 14日前 Write() で拒否しても、Claude Code は12回とも書き込んだ。効いていたのは Edit() だけだった Claude Code 2.1.275 で Write() の拒否ルールは効かなかったWrite(ファイル) は12回とも書き込みが成功、Edit(ファイル) は3経路すべてを停止Write() はファイルの拒否ルールで効かないため、Edit() に置き換える必要がある #AIエージェント#バックエンド#DevOps・CI/CD