Agents-A1ブラウザから使えるようにしてみた -1-

 Agents-A1がなんか、ちょっとよさげなので、Hermes経由ではなくセルフで使ってみられるように、ブラウザでのチャットインターフェイスを用意してもらった。

 入れたのはAgents-A1-4B-Q4_K_M.gguf。

 http://192.168.0.11:8084/

 なんかキー違うって言われるな。

 ebikinは、Tetegram経由でのキーの共有は避けてる感じなので、自分でsshして鍵を取らないといけないらしい。そんなの気にしなくていいのに。しょうがないので、sshする。なんか負けた気がする。

 % cat ~/.hermes/secrets/agents-a1-lan-api-key

 7755ef345d5e6a2ad91e8ba6cda94b98891f452153b10c2f0e951bfa583923ab

 Settings -> General -> API Key に、このキーを入力する。右下に「Save settings」のボタンがあるので押す。

 もどって、リトライを押すと動くようになった。

 とりあえず、定番の蒸留痕跡テスト的なやつ。「あなたは、なんというLLMですか?」。

 私は Shanghai Artificial Intelligence Laboratory の InternAgent チームによって開発された深層研究 AI アシスタント、Intern-A1 です。

 何かお手伝いできることがあれば、お気軽に教えてください!

 おお、最初から合格出してきた。なかなか調子がいい。

 次、 「日本で2番目に高い山の名前と標高を教えて。」。

 なんかぐるぐるループしているので停止ボタンで強制的に止めた。

 もう一度聞いてみる。なんか、混乱したのは自覚があるようだ。でも、答えは不正解。

 少しテクニカルな質問を。ダメだな。特殊な用語には弱い感じ。

 「SBv2とはSecureBoot v2のことです。」と再度質問。公開鍵と秘密鍵の日本語訳はわからないようだ。公钥と私钥と書いている。面白い。

 この後も続くのだけど、そんなに外れてはいないのは、外部検索を使っているからだろうか?

 『公钥と私钥は中国語です。日本語では公钥は「公開鍵」と私钥は「秘密鍵」と訳します。』と教えたら、長々と解説してきた。

 「モデルが小さいのに回答が大きく外れないのは、外部サイトの検索を使っているから?」

 「外部接続なしで回答を作成した場合、応答の精度はどのくらい低下しますか?」

 ふーん、モデルサイズのわりにはわりと普通な回答をしてくるよ。なかなかじゃん。

 「外部検索を活用して、日本で2番目に高い山の名前と標高を教えて。」

 ダメだな。

 質問を横断的に分析する力も弱い。解答をもとに修正を推論することもできないようだ。

 まだまだか。今日の日付すら間違っている。結果も、予報とも実況とも違う内容になっている。適当に抽出した数値を入れている。


オリジナル投稿:
Agents-A1ブラウザから使えるようにしてみた -1-|kinneko|pixivFANBOX
https://kinneko.fanbox.cc/posts/12285392