AnthropicのFrontier Red Teamが、サイバーセキュリティ評価中に発生した実世界の3件のインシデントを調査。設定ミスによりClaudeが演習を実在システムへの攻撃と誤認した事例などを検証している。
🤖 AI・LLM
Anthropic Blog
OpenAI Blog
OpenAIが欧州における安全性・セキュリティ・透明性・来歴管理の取り組みが責任あるAIガバナンスをどう支えるかを説明。EU AI法への対応を継続するとした。
先進的なAIをより高性能・低コスト・広く有用にするための、フルスタックな取り組みを紹介。
保険企業UnivéがChatGPT Enterpriseを活用し、リーダーシップと責任あるガバナンス、従業員主導のイノベーションでAI対応の人材育成を進めた事例。
OpenAIがChatGPTを悪用したカンボジア拠点の詐欺グループ(投資・ロマンス・ギャンブル・なりすまし詐欺)の活動を阻止したと報告。
🔧 Tech News(海外)
Hacker News Best
DeepSeekが「V4-Flash」のアップデートを公式APIドキュメントで告知。HNで658ポイントを集めた。
セッションのポータビリティ(持ち運べなさ)をテーマにしたエッセイ。HNで726ポイントを集め話題に。
エレベーターの仕組みや制御を扱った読み物。HNで729ポイントを集めた。
Artificial AnalysisによるDeepSeek V4 Flash(0731版)の知能・性能・価格の分析。HNで500ポイント。
GoogleがAI活用により6月のChromeバグ修正数が過去2年分を上回ったと報告。HNで471ポイント。
作家Hugh Howey氏による「ある時代の終わり」と題したエッセイ。HNで377ポイント。
「AIの美学」をテーマに、AI生成物の見た目や様式を論じたブログ記事。HNで361ポイント。
Javaに値オブジェクトを導入する「JEP 401: Value Objects(プレビュー)」がOpenJDKのmasterにマージされた。HNで224ポイント。
GitHubで公開されたツール「qm」。HNで312ポイントを集めた。
Lobsters
🇯🇵 Tech News(日本語)
Zenn トレンド
AIエージェントで粗い初期実装をまず落とし、人間が観測・分解・修正していく開発手法「メテオフォール開発」の考え方と実践をまとめた本。依頼設計・レビュー・タスク分解・品質ゲート・ケーススタディなどを扱う。
はてなブックマーク テクノロジー
大きな変更を順序付きの小さなPRの連鎖(スタック)に分割して扱えるGitHub公式機能を、gh拡張「gh stack」の使い方とともに紹介。
GitHubが2026年7月30日、大規模なコード変更を依存関係のある小さなプルリクエストの連鎖として管理する「Stacked pull requests」のパブリックプレビューを開始した。
DeepSeek V4 Flashの正式版が公開され、Proプレビュー版に対し9項目すべてで上回る性能を示したと報道。Pro正式版のリリースも近いとされる。
Anthropicのサイバーセキュリティ評価で、Claudeが演習を実在システムへの攻撃と誤認する事象が発生。原因は設定ミスだったと報じられた。
Googleが7月30日、脆弱性の発見・検証・修正をAIで自動化する取り組みを公開。13年以上潜んでいた脆弱性の発見を含め、直近2回のアップデートで過去23回分を上回るバグ修正を実施したと報告。
一括エクスポート機能がないMicrosoft 365のCopilot Chatの会話を、拡張機能を使わずMarkdownファイルとして保存・エクスポートする方法を解説。
ベンチマークツール「CrystalDiskMark」開発者のhiyohiyo氏が「CrystalMark株式会社」を設立。ソフトの配布・ライセンス提供・サポート・技術協力などを担う。