三年来AI新增了十多项基础能力
近三年来AI给我们带来了这么多新基础组件,想想还有点不可思议:
- 本地模型(2023年:Llama、Ollama、LM Studio)
- 声音克隆(2023年:ElevenLabs)
- 文本转CAD(2023年:Zoo)
- 文本生成视频(2024年:Sora、Veo、Runway)
- 实时语音(2024年:Gemini Live、ChatGPT Voice)
- 记忆(2024年:ChatGPT)
- 推理模型(2024年:OpenAI o1、DeepSeek R1)
- 氛围编程(2024年:Bolt、Lovable、v0)
- 计算机操作(2024年:Claude、OpenAI Operator)
- 连接器(2024年:MCP)
- 深度研究(2024年:Gemini、Perplexity、OpenAI Deep Research)
- 智能体(2025年:Claude Code、Codex、Manus)
- 图像编辑(2025年:GPT-4o images、Nano Banana)
- 智能体支付(2025年:x402、AP2)
- 技能(2025年:Claude Skills)
- 个人智能体(2026年:Grokbot、Muse、Instinct)……我们现在已经发展到这里了。
这些方向中的每一个,都是数百家公司的起点。我目前观察到最有意思的项目,是将其中两到三个方向结合,切入特定细分赛道!
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖