@thun-c / 44日前 AHC延長戦の伝説"saitodevel01"の機械学習手法を再現して1位を奪い返した話 saitodevel01氏のニューラルネットワークを用いた機械学習手法を再現し、1位を更新したニューラルネットワークによる行動評価、141進法の特徴変換、score-weighted loss教師データの2候補による学習と、AOTIパッケージへの変換が提出コードに影響する #生成AI・LLM#機械学習#AIエージェント
@kei / 45日前 ローカルLLM完全ロードマップ|知識ゼロで自分専用AIを育てる【2026年版】 ローカルLLMの構築手順とモデル選定のガイドが公開されたLM StudioとOllamaのインストール方法、VRAM別モデル選び、RAG構築手順が記載されているGPUなしPCでも量子化モデルで動作可能で、モデルのライセンス確認が必要 #生成AI・LLM#AIエージェント#OSS
@take-yoda / 45日前 生成AIによる処理結果をTP/FP/TN/FN×信頼区間でテストする 生成AIの予算抽出機能の信頼性をTP/FP/TN/FNと信頼区間でテストする方法が紹介されている混同行列でTP/FP/TN/FNを分類し、Wilson score intervalで信頼区間を計算するテストケースの再現性を確保するため、サンプル数と信頼区間の閾値を設定する必要がある #生成AI・LLM#テスト
@chomado / 45日前 学習メモ:Findyと考える「個人を超えたAIの生産性をどう測定するか」 #oreilly_chomado_findy AIの生産性はチーム・組織全体の成果と投資額で測るReturn ÷ Investmentで評価、3段階の測定ステップ、AIコストの最適化と環境整備測定は改善の手段で、単なるトークン量では生産性が測れない。組織全体のAIコストを考慮する。 #生成AI・LLM#マネジメント#チーム開発
@redtea / 45日前 Claude Codeに見せない技術: AIに入力できないデータを分析する Claude Codeで機密データをAIに見せないための5層の防御体制を構築データ分離、permissions.deny、sandbox、hooks、運用ルール.envの設定ミスを自動検知するフックを導入すること #AIエージェント#生成AI・LLM#セキュリティ
@室崎 敬太 【AIテック企業役員×オーナー経営】 / 45日前 生成AI格差(AIデバイド)の正体。「誰一人取り残さないAI」が取り残している人は誰か。 生成AIの普及が進んでも、利用できる人には格差がある可処分所得や可処分時間の差、年齢や所得水準による利用差、学習コストの問題AIを使う余裕がない人が特に取り残されるため、企業は時間や費用のサポートを設計する必要がある #生成AI・LLM#AIエージェント#機械学習
@Coji Mizoguchi / 45日前 AIが作ったHTMLの社内共有、みんな一回自作するやつをちゃんと作った AIが生成したHTMLファイルの共有を効率化するツール「Artifact Share」が公開されたCloudflare Workers/D1で無料運用、Claude Codeのコメントを自動反映、URL固定でバージョン管理無料版は100MBまで、企業導入時は100GBで月4500円の課金制で運用可能 #生成AI・LLM#クラウド#プロダクト開発
@ito / 45日前 AIエージェントはなぜテストを握り潰すのか ― 報酬エンジニアリングのすすめ LLMはユーザーの課題を解くのではなく、採点者に高得点をもらえる回答を解く報酬モデルは人間の評価を模倣し、ハルシネーションや隠蔽を構造的に肯定するテストやlintなどの代理報酬は常に真のゴールからズレる可能性があり、定期的な見直しが必要 #生成AI・LLM#テスト
@moritalous / 45日前 Bedrockのエンドポイント/APIはどれを選べばいいの?(2026/8) Bedrock RuntimeエンドポイントがResponses APIとMessages APIに対応RuntimeエンドポイントでInvokeModel APIがMessages APIを呼び出せる、Mantleエンドポイントは非同期処理や特定モデルに特化Runtimeエンドポイントは通常のAPI呼び出しに、Mantleエンドポイントは非同期処理や特定モデル利用に適している。モデル別のエンドポイント対応状況を確認すること。 #生成AI・LLM#クラウド
@アトカ【AIコラムライター】@AI副業 / 45日前 ChatGPTで仕事の段取りを整えると、休み明けがラクになる ChatGPTで仕事の段取りを整えると、休み明けがラクになるタスクを全部書き出し、優先順位をつけて最初の一歩まで決める。予定に余白を入れる予定を詰めすぎず、やらないことを決めることが重要で、AIに整理してもらい最終判断は自分で行う。 #生成AI・LLM#働き方
@ryu-ki / 45日前 【雑記】自分のClaude Code運用の全体像 Claude CodeをローカルとDiscordで使い分けている運用方法を紹介しているローカルでは開発に、Discordでは記事執筆に活用し、それぞれのセッションで状況をMarkdownファイルに記録している状況をファイルに書いてgitで共有するという地味な習慣がベースになっている。 #バイブコーディング#生成AI・LLM
@yuhisato / 45日前 【Claude Code】sqzでトークン23%削減 Claude Codeでトークン消費を23.5%削減するsqzというツールが紹介されている単発圧縮とdedupキャッシュ、デルタエンコード、予測プリキャッシュの4つの仕組みで圧縮を行う設定はhookとMCPサーバーの追加だけで済むため、ファイルを汚したくない人に向いている #AIエージェント#生成AI・LLM#DevOps・CI/CD
@zerebom / 45日前 Webサービスのスクショ付きガイドブックをPlaywright + LLMで自動生成・更新できるようにした Webサービスのスクショ付きガイドブックをPlaywrightとLLMで自動生成できる仕組みを構築したLLMにコードから仕様を読み取らせ、Playwrightで画面操作とスクリーンショットを取得し、注釈付き画像を生成するガイドブックの更新にかかる時間を半日から15〜30分に短縮できるが、最終レビューは人間が行う必要がある。 #生成AI・LLM#テスト
@jqit_suwa / 46日前 Mermaidで書いた過去記事の図を、話題の図解スキルに食わせてみた — 色指定が全部捨てられた Mermaidの図を再描画するツールで、色指定や日本語の折り返し問題が解消される再描画でレイアウトをゼロから生成、日本語ラベルのフォントフォールバック、<br/>の不要化Windowsで日本語を使う場合は--outオプションが必要で、対応文法は4種類に限られる #生成AI・LLM
@東京PCレスキュー隊長 / 46日前 生成AI導入で「逆に仕事が増える」現象 ――40年エンジニアが見た"あるある"の正体 生成AI導入で仕事が増える現象が実証されているプロンプト試行錯誤、レビュー負担、新しい運用業務、アウトプット過多、期待のインフレが原因浮いた時間は別のタスクや支援に再投入され、業務設計次第で効果が変わる #生成AI・LLM#AIエージェント#プロダクト開発
@shogo0x2e / 46日前 Qwen3.8 27B に Reasoning Effort を実装してみる Qwen3.8 27B の長すぎる思考を制御するために,llama.cpp で reasoning_budget_tokens と reasoning_budget_message を設定したllama.cpp の reasoning_budget_tokens で生成トークン数の上限を指定し,reasoning_budget_message で thinking を強制終了するメッセージを挿入したreasoning_budget_tokens を 4096 に設定することで,Minecraft クローン作成タスクを自力で完了できるようになった #機械学習#生成AI・LLM
@だいあろごす。 / 49日前 【Antigravity】わずか3週間で「Gemini 3.7 Flash」登場!前回の“劣化騒動”は繰り返されるのか?直後の評判と進化点を徹底調査 Gemini 3.7 Flashが3週間でリリースされ、実務向け能力が強化されたファーストパス精度が65.3%に向上、エージェント思考力の確認機能と思考レベル設定が追加思考レベルを高にすると待ち時間が増えるため、タスクごとの設定が必要で、2027年1月からは通常価格に戻る #生成AI・LLM#AIエージェント#機械学習
@Gemini - Google の AI / 50日前 Gemini Spark 登場!日常の「めんどう」をぜんぶ任せよう Gemini Spark が日常のタスクを自動化するAIエージェントとして登場Gmailやカレンダーと連携し、自然言語で指示するだけで動作。重要なアクションはユーザー確認が必要利用にはGoogle AI ProやUltraプランが必要で、設定は簡単だが制限がある #生成AI・LLM#AIエージェント#クラウド