很久没写博客了,最近对AI有很多新的看法
之前写的OpenAI看法 已经完全被改变了
以下主要讲讲Codex和他的相关产品及竞品:
Codex(AI Agent代表)
20💲超值体验,好用到无与伦比,让模型真正为你在电脑上干活,强大的模型配上强大的Agent框架,再搭配强大的产品设计团队,比HermesAgent和OpenClaw都省心。我甚至能看到,随着AI整体发展,让模型的速度继续提升,再为模型配上实体,Codex的Next版本直接能够替代大部分工种。
ChatGPT(Chatbot代表)
据说调研显示,在OpenAI公司内部,大部分的工作已经完全被Codex代替了,ChatGPT使用率直线下降。这个我很有感触,要不是因为Codex经常限额,我宁愿把所有的任务都交给Codex来完成,ChatGPT有时候过于偷懒(因为大多数时候都是单步执行任务),而关键就在于,这个世界大部分的任务/问题,都不是单步就能规划清楚/搞明白的,AI Agent相比于ChatBot最大的进步,就是根据上一步的结果来调整下一步方向,实时改变决策,保证每一步都走在最优路线上,从而高效率的完成任务。
APPLE
OS26 让我很失望,糟糕的细节和各种半成品,系统卡顿等等数不清的问题,甚至让我一度产生了换Android的想法..... 我曾经说,Apple做AI不行,如果做UI也不行,那就等着完蛋吧。
还好,Alan Dye走了,真好,求求你再也别回来了,祝你带领Meta走向辉煌。
新的OS 27 ,让我重新感受到了Apple在UI/UX设计上的实力,请把接下来的工作做好,并快速转向AI相关。
新的电子产品,很快就会出现“iPhone时刻“。
留给你们的时间,真不多了
Gemini / Antigravity
Google最近很不顺,像Apple前段时间一样。
今年发布的3.5 Flash,真的好像是赶鸭子上架的半成品模型,性能打不过3.1Pro,价钱也没预期那么便宜,唯一的优势可能就是速度极快,真的是非常非常快,比我用到的任何模型都快,被国内网友亲切的称之为“美国豆包“。
而Google最大的问题,还不在于此,而在于Agent基础框架和产品力上的反应迟钝。
Google已经不是那家小而美的团队了,这不仅从人员数量上能看到,从Google的所有产品中,都有明显的表现,以下是我常用的几个产品:
Gmail到现在为止都不能称之为AI Mail:背靠Gemini,在Gmail上只是做了个侧边栏,实属说不过去。
GooglePhots:目前只有AI搜索和简单的AI改图,整体相册逻辑偏保守。
Google Drive:一个不痛不痒几乎用不到的AI侧边栏。
Google Maps:目前没有看到任何与AI相关的功能,参照高德地图。
以上都是Google的老牌产品,虽然没AI功能,但从软件1.0的角度来看,产品力都是非常可以的。
接下来说AI相关产品力不足的问题:单独使用Gemini的时候发现,在体感上,3.1Pro的性能其实和GPT5.5差不多,但在使用Antigravity的时候,两者的差距,可谓一个天上一个地下,Antigravity完全无法与Codex竞争,主要是以下几个方面:
产品的设计理念:Antigravity每次执行命令的时候,都需要人工进行干预审批,我也是这个的受害者,每次开始执行任务后,都需要在电脑旁边一条一条等着审核,我审批AI执行命令总有一种盖萝卜章的错觉,对于程序员出身的我来讲,有些命令尚且看不懂,更何况那些完全不懂Unix命令的人呢?体验可想而知。而反观Codex,早已将“替我审批“功能上线,极大的优化了产品的易用性。
团队迭代速度:在网上搜索了这个问题,从2025年底讨论到2026年中,将近大半年的时间,也没能解决。
三方开发生态差:我还不太清楚Antigravity是否使用 ADK 开发,但我自己写Agent工程,最开始用的就是ADK,我提的一个 release,到现在为止也没有人来解决,只能迫不得已使用 OpenAI 的 AgentsSDK,结果发现 OpenAI 的 SDK 更新速度特别快,而且也比 ADK 好用太多。
据说3.5Pro也延期了.....
在这个每天都在快速变化的时代,我觉得 Google依然需要不断转型,改变团队结构。
我觉得只要他们做对了决策,将来一定能够追上来。虽然反应确实慢了一些,但凭借他们在数据方面的积累,将来依然是很有希望的。