これでまた自社LLM/SLMのハードルが下がったのではないでしょうか?

 

<総まとめ>
Petri(Parallel Exploration Tool for Risky Interactions)は、複数の AIエージェントを用いて対象モデルに数千件の会話を仕掛け、36の評価軸でスコア付けして問題行動をあぶり出す仕組み。従来の手動チェックを大幅に補完でき、安全性評価の初期スクリーニングとして有力なツールとなる可能性があります。

 

<ちょっとした気づき>
「どんな行動をテストしたいか」を自然言語で指示できるという点、実務的には“企画段階でどの種の誤用リスクを重点チェックするか”を先行して議論できるヒントになります。
https://aiupdate.blog/anthropic-petri-ai-safety-testing-tool-100825/?utm_source=chatgpt.com

ISAOの管理部門のAI導入事例

AIは、こうした小さな「動かない」でつまずきます。ISAOは、その先——実際の業務に
AIを乗せて回すところまでを、お客様の管理部門と一緒に進めています。

月次決算の工数を50%以上削減|東証グロース上場企業A社

少人数の経理財務部門で、決算業務を1本ずつAI化。外注に頼らず社内で決算を完結
できる体制をつくりました。(Claude Cowork/Microsoft 365 Copilot)

詳細はこちら

全社でAIを使わない日がない状態へ|医薬品・上場準備企業

ツールを配って終わりにせず、顧問として伴走。安全に使える環境の整備から
リテラシー向上まで。G検定の合格率は100%。

詳細はこちら

収益認識の判定をAIエージェント化|創薬支援CRO

月100件を超える契約の収益認識判定を、監査証跡を保ったままAIがドラフト。
ドラフト・レビュー工数を75%以上削減しました。

詳細はこちら

「AI管理部長」を数年かけて共同研究|東証上場のIT企業

管理部門の業務をAIが担う仕組みを研究。汎用LLMで足りる部分と、自社で作り込む
べき部分の線引きを実務で検証しています。

詳細はこちら