@Miccell(ミクセル) / 人生を楽しむ仕組みを作る / 12日前 Jev登場。ChatGPTの生みの親が作った「しゃべらないAI」、GPT-5.6 Terra級の判断を桁違いの速さと安さで Jevは文章を生成しない代わりに、圧倒的な速さと安さで判断を返す新しいAIモデル文章生成ではなく数値やカテゴリなどの形式化された答えを並列で出力、RLHF技術の開発者による設計ハルシネーションが原理的に起きないが、文章の説明や複雑な理由付けは苦手な設計 #生成AI・LLM#AIエージェント#機械学習
@Ninagawa123 / 12日前 5分でJev入門(すぐ使う) Jevは超短い回答を即座に返すAIツールとして紹介されているnoulタイプでYes/Noの判断をパーセントで返す、choiceやscoreタイプも利用可能登録後数時間かかるため、実際の利用には時間的余裕が必要 #AIエージェント#生成AI・LLM
@Lucas Ropek / 12日前 アンドリーセン・ホロウィッツが支援するVals、AIベンチマーキングの新たな基準を目指す ValsはAIベンチマーキングの新しい基準を目指し、アンドリーセン・ホロウィッツから4000万ドルを調達したベンチマーキングのテスト内容を公開せず、法律や金融、コーディングなどの特定業界の複雑なタスクを評価する企業がモデルの性能を正確に測定し、改善に役立てることで、ベンチマーキングがAI企業の信頼構築に重要になる #AIエージェント#生成AI・LLM#機械学習
@kf_webdev / 12日前 生成AIセキュリティを学んで変わった「AIを安全に使う」という考え方 生成AIセキュリティを学ぶことで、情報の扱い方やPrompt Injection、RAGのセキュリティ対策が変わる情報の分類、直接・間接Prompt Injection、RAGの検索段階でのアクセス制御、多層防御AIに渡す情報の判断基準を自分自身で設定し、データの中にも指示がある可能性を考慮する #生成AI・LLM#AIエージェント#セキュリティ
@だいあろごす。 / 12日前 【Antigravity】AIへの指示書が共通化する?Claude Codeが「AGENTS.md」に対応 Claude CodeがAGENTS.mdに対応し、AIエージェント向けの共通指示書が広がり始めているAGENTS.mdはプロジェクトの基本情報やルールを記載する共通形式で、Claude CodeとGoogleのmanaged Antigravity Agentで利用可能Antigravityユーザーは現状維持で問題ないが、今後のAI環境構築に影響が出る可能性がある #AIエージェント#生成AI・LLM#OSS
@Amanda Silberling / 12日前 Tilly NorwoodのプレスツアーはAIとしての評判を落としている Tilly NorwoodというAIが初のプレスツアーで不具合を起こしているAIが中国語を突然話す、質問の意図を理解できない、ハイブリッド制作の説明で混乱AIが人間のように振る舞うと誤認されるリスクがあるため、不具合が目立つと話題になる可能性がある #AIエージェント#生成AI・LLM
@Isaka-code / 12日前 Jevはどこで使うべきか? LLM・機械学習・ルールベースとの使い分け Jevはテキスト入力に対して事前に定義された選択肢やスコアを返す決定モデルルールベースと古典的機械学習、LLMと比較して入力がテキストで出力候補が事前に決められる場合に適する教師データが十分でない場合や高速・低コストな処理が必要なときにJevが選択肢になる #AIエージェント#生成AI・LLM#機械学習
@Kirsten Korosec / 12日前 物理AIに特化したスタートアップ支援企業が1億ドルを調達 Vantoraは物理AIスタートアップを企業向けに開発し、1億ドルを調達した企業向けに特化した物理AIスタートアップの開発と、買収パイプラインの構築企業が自社のインテリジェンス層を所有する必要があるため、外部への提供が制限される #AIエージェント#生成AI・LLM#インフラ
@Julie Bort / 12日前 Anthropicはバイオロジー実験を行うウェットラボを運営している Anthropicはバイオロジー実験を行うウェットラボを運営しているAIモデルで物理実験を実施し、基礎生物学に焦点を当てている、外部パートナーと共同研究している薬品開発ではなく基礎生物学に注力し、製薬業界との競合を避ける方針を取っている #AIエージェント#生成AI・LLM#機械学習
@Aditya Mehta / 12日前 AIの誤認が米軍作戦を危機に陥れる AIチャットボットの誤認が米軍の軍事作戦を引き起こす危機にAIが開示した情報が誤っており、分析者が2回にわたって処理した軍事決定にAIを使う際の信頼性と人間の確認の重要性が指摘される #AIエージェント#生成AI・LLM#セキュリティ
@Tim Fernholz / 12日前 Anthropicの最初の埋め込み評価者は…アカントゥア? AnthropicがAccentureをAIモデルの安全評価に採用したAccentureはAI評価とモデルの整合性確認、セーフガードのテストを行う。AI安全研究機関METRやRedwood Researchとの協力も検討中AIモデルの安全性を確保するための評価体制が変化している。評価者のアクセスやコミュニケーションの基準はまだない #AIエージェント#生成AI・LLM#セキュリティ
@Russell Brandom / 12日前 世界モデル企業は多くの秘密を保持している 世界モデル企業は多くの技術を秘匿しており、商業化の具体的な計画を公表していないAMI LabsとWorld Labsが空間知能の自動化に焦点を当て、製品計画やタイムラインを非公開にしている。また、サプライヤーも具体的な用途を知らない企業は資金調達の容易さを活かして競合の発見を遅らせるために情報を隠している #AIエージェント#生成AI・LLM#機械学習
@Tim Fernholz / 12日前 ChatGPTの共同発明者が開発した新しいAIモデルが開発者に注目されている ChatGPTの共同発明者が開発した新しいAIモデルが開発者に注目されている確率を出力するTransformerベースのモデルで、LLMとは異なるアプローチを取る。コストと速度に優れ、 hallucination が起こらないLLMの代替や補完としての利用が可能で、ソフトウェア自動化に適している。開発者はこのモデルをより安く正確に利用できると評価している #生成AI・LLM#AIエージェント#機械学習
@Lucas Ropek / 12日前 ディズニー初のCTOが元キャラクターAIのCEO ディズニー初のCTOが元キャラクターAIのCEOキャラクターAIはディズニーのキャラクターを模倣したとして訴えられ、自社のAIスタートアップ出身者をCTOにディズニーがAIスタートアップ出身者をCTOに起用し、技術革新を推進する姿勢を示した #AIエージェント#生成AI・LLM#キャリア
@Sarah Perez / 12日前 Googleの新しい「CC」は家族の家事運営を支援するAIエージェント Googleが家庭向けAIエージェントCCをリリースしたCCはメール、カレンダー、チャット、タスクで動作し、家族のスケジュール管理やタスク処理を自動化する。AIエージェントはGeminiとAntigravityで動作するアメリカの個人Gmailアカウントを持つ18歳以上の人しか利用できないが、学校のメールアカウントでは利用不可で、ティーンエイジャーは年齢を偽る必要がある #AIエージェント#生成AI・LLM#クラウド
@Theresa Loconsolo / 12日前 Dario Amodeiと他のAIリーダーは「フロントラインをペースする」を望むが…どうやって? Dario AmodeiがAI開発の進捗を「ペースする」プランを発表した独立した安全評価者と民主主義国のAIラボ間の協調が中心。NvidiaのJensen Huangから批判を受けているAI開発の進捗を制御するための枠組みが議論されている。業界の支持と批判の両方が存在する #AIエージェント#生成AI・LLM#機械学習
@はこいぬ / 12日前 ローカルJevの可能性検証 Gemmaをベースにした3つの構成でJev風の判断モデルを実装し、日本語の3択分類タスクで比較した案Aはトークンスコアから確率を計算、案Bは分類ヘッドを追加、案Cは共有採点ヘッドで候補を評価LoRAによる追加学習で正答率が8割を超え、生成不要の構成でも高速な推論が可能だった #生成AI・LLM#機械学習#DevOps・CI/CD
@Ram Iyer / 12日前 Manus、40億ドル評価で5億ドル調達を検討、メタとの合併中止後も独立運営へ Manusは40億ドルの評価額で5億ドルを調達中IDG CapitalやTencentなど複数の投資家が関与、AIエージェントとバイブコーディングツールを提供中国の規制でメタとの合併が中止され、独立運営を再開した #AIエージェント#生成AI・LLM#バイブコーディング
@Dominic-Madori Davis / 12日前 家族オフィスがAI投資に殺到 家族オフィスがAI分野に集中投資し、従来のベンチャーキャピタルではなく直接取引や二次市場に注目している直接取引や二次市場での投資が増加し、ベンチャーキャピタルの盲目的なファンド投資を避ける傾向AI分野への投資が急増しているが、過熱した市場でリスク管理が重要になる可能性がある #AIエージェント#生成AI・LLM#クラウド
@TechCrunch Events / 13日前 Open or closed AI? NvidiaのNader KhalilとSydney SykesがTechCrunch Disrupt 2026で次世代スタートアップに影響する決定を議論 AIスタートアップがオープンモデルと特許モデルの選択を迫られるオープンモデルはコストと制御のバランス、特許モデルは差別化とインフラの維持が課題選択はコスト、インフラ、マージン、差別化、スピードに直接影響する #AIエージェント#生成AI・LLM#OSS