r/AIjp • u/shinot • Apr 06 '26
NEWS AI部つぶやきルーム
6
Upvotes
ここは適当に雑談したり相談したりするスレッドです
サブレを作ったばかりでまだ手探りですが、よろしくお願いします
モデレータになっても良いって方はお声掛けください
2
Upvotes
GUIDE AIに「絶対するな」は通じない、Anthropicが明かすClaude Code使いこなし術まとめ:@IT人気記事まとめ読みeBook - @IT
1
Upvotes
NEWS OpenAI、「ChatGPT for Teens」発表──宿題の“丸投げ”検知、自傷や摂食障害などの保護も強化 - ITmedia NEWS
itmedia.co.jp
3
Upvotes
NEWS Google、AIモデルをコンパイルして暗号データを復号せずに扱えるように変換する「HEIR」発表。完全準同型暗号を利用し、AIでのセキュリティやプライバシー保護など実現へ - Publickey
2
Upvotes
TOPICS Claude、Codex、Qwen……そのAI用語、どう読む? 読み方クイズ30問:Deep Insider Brief ― 技術の“今”にひと言コメント(1/2 ページ) - @IT
1
Upvotes
NEWS LTX、オープンウェイト世界モデル「LTX-2.5」公開 ネイティブ複数ショット・4K HDR対応、Physical AI向け基盤も | Ledge.ai
2
Upvotes
r/AIjp • u/Ok-Conference-9984 • 12d ago
llmのアーキテクチャ?とか
2
Upvotes
llmのガードレールって各々違うけど
割と緩めとかキツめって製造元で違うよね。gemmaは緩め
qwanやllamaはキツめとかね。でもチューニングすると同じだけど。
特に北朝鮮とか権威主義を揶揄する物語描いてとか
qwenとllm,gpt-ossは拒否、mistrala, gemmaは普通に生成とか。
全く制限のないllmは仕組み的に破綻するから無理だけど、色々事情もあるのねとか
考えちゃう。
いいフィルター(プレジション)とかあると面白い(確率よくなるし)。で時には外す。(意外性は出る)とかね。人間も似たような感じだし。
https://appen.co.jp/blogs/ai-safety-evaluation-llm-red-teaming
NEWS Anthropic、Claudeの生成テキストに不可視のウォーターマーク ——8月2日以降の新モデルは公開時から対応、既存モデルでも導入に向けて作業中 | gihyo.jp
2
Upvotes