Tag
#hn-score:133
4件
LLM推論初出 8/13 22:05
AIモデルの選択:プロンプトは1つ、モデルは11種類、結果は異なる
AIモデルの選択は、プロンプトの種類や期待する結果によって最適なモデルが異なります。11種類のモデルを比較検証することで、用途に応じた最適なモデル選定の指針を示しています。
https://hacker-news.firebaseio.com/v0
LLM推論初出 7/31 03:13
Show HN: DeepSeekをGPT-OSSに蒸留しても検閲は移行しない。試してみて
「Distilling DeepSeek into GPT-OSS」は、DeepSeekモデルの知識をGPT-OSSに蒸留する手法を提示しています。このプロセスは、DeepSeekの検閲特性をGPT-OSSに転移させないことを実証し、オープンソースLLMにおける検閲問題への新たなアプローチを示唆しています。
https://hacker-news.firebaseio.com/v0
LLM推論初出 7/8 02:44
Fable 5へのアクセスを7月12日まで全有料プランで延長します
Fable 5へのアクセスが、有料プラン全般において7月12日まで延長されることが発表されました。ユーザーは引き続きFable 5の機能を利用できます。
https://hacker-news.firebaseio.com/v0
LLM推論2本の記事が同じ件を報じた初出 7/2 21:10
1つのレイヤーで十分か?単一のTransformerレイヤーがフルパラメーターRLトレーニングに匹敵
単一のTransformerレイヤーで、フルパラメータの強化学習トレーニングと同等の性能を達成できる可能性が示唆されています。これにより、モデルの効率化と計算コスト削減が期待されます。
https://hacker-news.firebaseio.com/v0