@HELLO_CYBERNETICS / 12日前 Jevを、自然言語で分類基準を渡せる識別モデルとして使う Jevは自然言語で分類基準を指定できる識別モデルとして使える質問と候補の説明を変えることで配送担当や実験報告書の分類が可能、確率出力で自動処理と人手確認の切り分けが可能分類基準の説明が曖昧だと誤判定のリスクがあるため、具体的な条件を明記する必要がある #AIエージェント#機械学習#DevOps・CI/CD
@Yasuhito Morimoto / 12日前 国内AIエージェント動向(2026/9/19号) 国内企業がAIエージェントの実装に向け、業務知識やデータの整備、権限管理、復旧機能を一体で設計しているKDDIの開発支援、ヘッドウォータースの業務知識整備、ジオコードの承認付きWeb改善、Cohesityの保護・復旧機能業務知識の更新責任や実行権限の設計、復旧手順の明確化が運用負担を減らす鍵となる #AIエージェント#機械学習#インフラ
@Isaka-code / 12日前 Jevはどこで使うべきか? LLM・機械学習・ルールベースとの使い分け Jevはテキスト入力に対して事前に定義された選択肢やスコアを返す決定モデルルールベースと古典的機械学習、LLMと比較して入力がテキストで出力候補が事前に決められる場合に適する教師データが十分でない場合や高速・低コストな処理が必要なときにJevが選択肢になる #AIエージェント#生成AI・LLM#機械学習
@Julie Bort / 12日前 Anthropicはバイオロジー実験を行うウェットラボを運営している Anthropicはバイオロジー実験を行うウェットラボを運営しているAIモデルで物理実験を実施し、基礎生物学に焦点を当てている、外部パートナーと共同研究している薬品開発ではなく基礎生物学に注力し、製薬業界との競合を避ける方針を取っている #AIエージェント#生成AI・LLM#機械学習
@Russell Brandom / 12日前 世界モデル企業は多くの秘密を保持している 世界モデル企業は多くの技術を秘匿しており、商業化の具体的な計画を公表していないAMI LabsとWorld Labsが空間知能の自動化に焦点を当て、製品計画やタイムラインを非公開にしている。また、サプライヤーも具体的な用途を知らない企業は資金調達の容易さを活かして競合の発見を遅らせるために情報を隠している #AIエージェント#生成AI・LLM#機械学習
@Tim Fernholz / 12日前 ChatGPTの共同発明者が開発した新しいAIモデルが開発者に注目されている ChatGPTの共同発明者が開発した新しいAIモデルが開発者に注目されている確率を出力するTransformerベースのモデルで、LLMとは異なるアプローチを取る。コストと速度に優れ、 hallucination が起こらないLLMの代替や補完としての利用が可能で、ソフトウェア自動化に適している。開発者はこのモデルをより安く正確に利用できると評価している #生成AI・LLM#AIエージェント#機械学習
@Theresa Loconsolo / 12日前 Dario Amodeiと他のAIリーダーは「フロントラインをペースする」を望むが…どうやって? Dario AmodeiがAI開発の進捗を「ペースする」プランを発表した独立した安全評価者と民主主義国のAIラボ間の協調が中心。NvidiaのJensen Huangから批判を受けているAI開発の進捗を制御するための枠組みが議論されている。業界の支持と批判の両方が存在する #AIエージェント#生成AI・LLM#機械学習
@はこいぬ / 12日前 ローカルJevの可能性検証 Gemmaをベースにした3つの構成でJev風の判断モデルを実装し、日本語の3択分類タスクで比較した案Aはトークンスコアから確率を計算、案Bは分類ヘッドを追加、案Cは共有採点ヘッドで候補を評価LoRAによる追加学習で正答率が8割を超え、生成不要の構成でも高速な推論が可能だった #生成AI・LLM#機械学習#DevOps・CI/CD
@harupython / 13日前 LLMの代わりになる? 文章を生成しないAI「Jev」を日本語で試してみた 文章を生成しないAI「Jev」は、判断と確率を返すモデルで、LLMとは異なる出力方式を持つChoice・Score・Noulの3種類の返り値形式、LLMのStructured Outputsとの出力方式の違いJevは文章生成せず判断と確率を返すため、処理に応じた使い分けが重要で、実際の性能は入力内容に依存する #生成AI・LLM#AIエージェント#機械学習
@dahatake / 13日前 AI コーディングエージェントの1タスクが8時間かかる理由を、45日分のセッション履歴から測ってみた AIコーディングエージェントの1タスクが8時間かかる理由は、文脈の積み上げと指示の不備が主因コンテキストサイズが100kトークンを超えると遅延が10倍に、検証スキルのロード不足と指示の無限スコープが原因指示に完了条件と時間上限を明記しないと1指示で200回以上のモデル呼び出しと400分以上の時間がかかる #生成AI・LLM#AIエージェント#機械学習
@Yasuhito Morimoto / 13日前 「話さないAI」Jevは何が違う? LLMと組み合わせて考える、効率化とコスト削減 Jevはソフトウェアに組み込む「判断係」のAIモデルで、問い合わせを分類するChoice・Score・Noulの3つの判断機能があり、出力は無料で入力単価が低いJevの入力単価はTerraの約48分の1で、出力無料の課金方式がコスト削減に繋がる #生成AI・LLM#AIエージェント#機械学習
@MOBILUS TECH BLOG / 13日前 TypeSafe AI - 現時点でわかっていることまとめ TypeSafe AIが新しいモデルJevを発表し、チャット機能を持たない判定AIとして機能するchoiceやscore、noulといった選択肢やスコアの判定機能と、確率の較正が特徴応答速度が高速で価格が安く、ビジネス用途に適しているがチャット機能がないため制限がある #生成AI・LLM#AIエージェント#機械学習
@shinkai_ / 13日前 「LLMじゃないAI」が来た! TypeSafe AI「Jev」はなぜ文字列生成を捨てたのか TypeSafe AIがLLMではないSystem One Modelsを発表、第一弾はJev並列サンプラーと型付き構造化出力、RLCDという独自の強化学習手法を採用出力コストが無料で応答時間が数十〜数百倍速いが、自由な文章生成は不可 #生成AI・LLM#AIエージェント#機械学習
@Phung Dinh Son / 13日前 Markdownは新しい攻撃ベクトルになった — AIエージェント時代の間接プロンプトインジェクション入門 プロンプトインジェクションはLLMの構造的制約であり、間接インジェクションが特に危険プロンプトインジェクションの2種類(直接・間接)、Lethal Trifecta(プライベートデータ・信頼不能コンテンツ・外部通信の3要素)プライベートデータへのアクセスを最小限にし、信頼不能コンテンツを厳しくチェックし、外部通信を制限する対策が有効 #AIエージェント#機械学習#セキュリティ
@Tamura Satoru / 13日前 AIペルソナはユーザーの代わりになるのか? 論文3本から探る、できること・できないこと LLMはUIの問題候補を挙げたり、人間と重なる定性的な論点を出したりできるDuan et al.はGPT-4でUIガイドライン違反を検出、Hwang and KangはAIペルソナで定性的テーマを抽出、Kuric et al.はGPTのクリック行動を実ユーザーと比較LLMの出力は実ユーザーの反応そのものではなく、仮説や予測として扱う必要がある #生成AI・LLM#AIエージェント#機械学習
@yushibats / 13日前 話題のJevとは?文章を書かずに判断だけを返すAIモデルをざっくり解説 Jevは文章を生成せず、選択肢ごとの確率と確信度を返すAIモデル選択肢から1つ選ぶChoice、段階評価のScore、Yes/NoのNoulの3種類の問いに対応。確信度で処理を分岐可能確信度が0.9以上なら自動処理、0.5以上なら人間確認、それ以下なら人が振り分け。計算や日付比較は不得意と明記 #生成AI・LLM#AIエージェント#機械学習
@aidasquid / 13日前 2026年版 LLM勢力図&モデルまとめ 2026年現在のLLM勢力図と主要モデルの特徴がまとめられているChatGPT、Claude、Gemini、DeepSeek、Qwen、Moonshot、Liquid AI、xLSTM、Jevなどのモデルと、Transformerの代替アーキテクチャが紹介されているLLMの性能やアーキテクチャの選択が開発戦略に直接影響するため、モデルの特徴を理解することが重要 #生成AI・LLM#AIエージェント#機械学習
@Yasuhito Morimoto / 13日前 国内AIエージェント動向(2026/9/18号) 国内のAIエージェント導入が業務実装、ナレッジ整備、運用定着へと移行している住友電装の監査AI、介入AI、レビューAI、アビームとNotionのAgent OS、TinyFishの自律Web操作AIエージェント導入の競争軸がモデル性能から業務実装、ナレッジ整備、運用定着、効果検証へ移行している #AIエージェント#機械学習#インフラ
@はたはた / 13日前 LightGBM Rankerを深掘りする:LambdaRankの仕組みと予測の中身 LightGBM RankerでLambdaRankを使うと、候補間の順位を入れ替えることでNDCGを最適化するLambdaRankはrelevanceの差に基づくΔNDCGを計算し、gain/splitで特徴量の分岐を決定する、グループ指定を誤ると順位学習が妨げられるグループ指定を誤ると別クエリのアイテムが比較対象となり、NDCG@5が4.6ポイント悪化する可能性がある #機械学習#バックエンド#DevOps・CI/CD
@Aditya Mehta / 13日前 Google DeepMind、AGIの議論を広げるインスティテュートを設立 Google DeepMindがAGIの議論を広げるインスティテュートを設立したAIの透明性の限界を克服するためのアプローチと、先端AIモデルの評価フレームワークを提案しているAI開発の安全性と規制のあり方について具体的な議論を進める必要がある #AIエージェント#生成AI・LLM#機械学習