就真的有用但不多,要用大量reasoning去換,而且很看harness。
上面是用thinking medium寫大概一千行上下的普通feature,基本開銷20k token repo prompt without skills。寫出來的效果不差,但3.1 Pro大概可以用1/10的Token量做完。而且3.1 Pro的per token price也才兩倍左右而已,開pricing flex大概就把優勢拉回來了。
輕量一點的用法就有點尷尬。輸出品質只比3.1 Flash好一點,可是價格是三倍。我自己用在gpt-commit上面是覺得不太划算。