#OpenAI
今日 22件4月1日(水)
· 1件3月12日(木)
· 1件2月18日(水)
· 1件1月28日(水)
· 1件ペンシルベニア大、
AI 起業講座を 実施 ペンシルベニア大学で 4日間の起業講座が実施されました。 学生は Claude Code と Google Antigravity で試作品を作りました。 AI 利用で従来の半年分を上回る進捗が得られました。
One Useful Thing(Ethan Mollick)
1月8日(木)
· 1件Ethan Mollick、
Claude Code を 検証 Ethan Mollick 氏が Claude Code を試しました。詳しくは出典へ。
One Useful Thing(Ethan Mollick)
2025年12月24日(水)
· 1件ABEJA、
gpt-oss-120b の 推論を 検証 ABEJA が gpt-oss-120b の推論能力を検証しました。 論理クイズや数学の問題を解かせて思考過程を観察しました。 設定は temperature 1.0、reasoning effort は high です。
ABEJA Tech Blog
2025年11月19日(水)
· 1件Ethan Mollick、
Gemini 3 を 検証 Ethan Mollick 氏が Gemini 3 と Antigravity を試しました。詳しくは出典へ。
One Useful Thing(Ethan Mollick)
2025年11月12日(水)
· 1件AI の
面接評価、 ベンチマークの 限界 Ethan Mollick が AI を面接で評価する方法を解説しました。 ベンチマークは公開や未校正などの問題を抱えます。 vibes による評価は個人向けで、標準化には不十分です。
One Useful Thing(Ethan Mollick)
2025年10月23日(木)
· 1件METR、
gpt-oss の 評価手法を 検証 METR が gpt-oss-120b の評価手法を検証しました。 悪意あるファインチューニング実験を対象としています。 17 件の提言のうち OpenAI は 9 件を採用しました。
METR
2025年10月20日(月)
· 1件Ethan Mollick、
AI 活用ガイドを 公開 Ethan Mollick が AI 活用の実践ガイドを公開しました。 主要モデルは Claude、Gemini、ChatGPT、Grok の 4 系統です。 有料プランは月 20 ドルと約 200 ドルの 2 段階です。
One Useful Thing(Ethan Mollick)
2025年9月30日(火)
· 1件Ethan Mollick、
AI エージェントの 実務利用を 分析 Ethan Mollick 氏が AI エージェントの実務利用を分析しました。詳しくは出典へ。
One Useful Thing(Ethan Mollick)
2025年9月12日(金)
· 1件Ethan Mollick、
魔法使い型の 協働を 提唱 Ethan Mollick 氏は AI との関係が魔法使い型に移ったと論じました。詳しくは出典へ。
One Useful Thing(Ethan Mollick)
2025年3月11日(火)
· 1件METR、
可読で 忠実な 推論の 価値を 説明 METR が AI 推論の可読性と忠実性の価値を解説しました。 可読で忠実な推論は AI のミスや欺瞞の検出を容易にします。 OpenAI や Anthropic など 5 社が推論モデルを公開しました。
METR