本地科技圈这两天都在传同一件事:DeepSeek要下场做agent了。SCMP的报道说,这家中国公司邀请开源开发者测试即将发布的"harness"——一个把大语言模型(LLM)改造成能自主执行任务的agent的软件层,同时最新的V4 Flash模型也在做进一步定价调整。
"harness"到底是什么
用大白话说,LLM本身只是"会说话",你问它问题它答你;agent则是"会办事"——它能读文件、调工具、写代码、点网页、跟其他系统对话,把一件事从头做到尾。中间那层负责规划、调度、记忆、纠错的软件,就叫harness。过去这一层基本被Silicon Valley的框架把持——LangChain、CrewAI等都是美国团队的产物。
DeepSeek这次的姿态很清楚:走开源路线,邀请社区一起测试、一起改。这是DeepSeek一贯的策略——V3发布时就是开源权重打到业界惊掉下巴,V4延续这个思路,harness再往前一步。
Silicon Valley第二次被降本震到
本站7月31日报道过OpenAI在DeepSeek和Cohere等对手的价格挤压下,把主力模型价格砍了大约80%——那是第一次冲击。DeepSeek这次V4 Flash的定价又把心理价位往下拉一档。SCMP用的措辞是"jolt"(震动)——这个词在过去几个月已经不是第一次用在DeepSeek身上。
对Silicon Valley的巨头意味着什么?简单说:光靠"模型质量"卖高价的时代结束了。OpenAI、Anthropic、Google都得在同等推理成本下继续拉开质量差距,才能撑住溢价,否则API利润会被中国厂商快速抹平。
对开发者和企业客户则是好事——训练/推理成本继续下降、开源生态继续拓宽。对温哥华本地做SaaS、做企业AI集成的团队,选择明显变多。
对温哥华华人科技从业者的意义
温哥华是加拿大西岸最大的科技招聘市场之一,本地不少华人工程师在AI/ML方向。DeepSeek这一波至少让几件事更明确:
第一,开源中文AI生态确实在追。以前很多本地朋友在用美国厂商的闭源API做项目,未来评估国产开源模型的技术方案会更容易过评审。
第二,agent方向是接下来一段时间的招聘热点。会用harness、能把LLM调成agent的工程师,市场价会继续走高。
V4 Flash的具体参数、上下文窗口、benchmark分数以及harness的开源许可细节,请直接看SCMP原文和DeepSeek官方发布,那里的数字最新。