在人工智能大行其道的今天,写代码变得前所未有的迅猛。但新问题也随之浮现:大模型吐出的海量代码到底靠不靠谱?测试与验证成了横亘在开发团队面前的一道新难关。正因如此,专注于代码测试与验证的初创企业Blacksmith迎来了爆发式增长。
近日,这家公司宣布完成新一轮 45 万美元的Series B融资,由PeakXVPartners领投,现有投资方GV和YCombinator跟投。让人瞩目的是,其估值在不到一年的时间里狂飙近 10 倍,从之前完成 1000 万美元A轮时的 6000 万美元一跃飙升至5. 5 亿美元,累计融资额达到了 585 万美元。

成立于 2024 年的Blacksmith,致力于帮助企业在软件上线前完成构建、测试与验证。随着Cursor、Codex以及ClaudeCode等AI编程工具的普及,代码生成虽然变得轻而易举,但质量把关却成了新的瓶颈。该公司创始人兼CEOAdityaJayaprakash指出,人们写的代码越多,验证的压力反而呈几何级数上升。
起初,Blacksmith以持续集成工作负载的云服务商切入市场。如今,其业务范围已经扩展到了包含自动修复失败代码检查的AI编程助手Codesmith。目前,该平台的客户群体已经从一年前的 700 多家暴增至 5000 多家,其中包括Mercury、Supabase、Clerk、Ashby和Expensify等知名企业。
在团队规模上,该公司仅凭借约 30 名员工就实现了“数千万美元”的年化收入跑率,部分大客户的年支出甚至超过了 100 万美元。不过,面对激烈的市场竞争,Blacksmith也正面临来自GitHubActions、各大AI工具内置验证功能,以及传统云巨头亚马逊云服务、微软Azure和谷歌云的合围。团队表示,未来将继续拓展代码工具生态,助力开发者以更高速度编写、验证和合并软件。
据《华尔街日报》报道,DeepMind联合创始人哈萨比斯卸任CEO前,曾与美国政府官员及多家AI实验室负责人讨论筹建独立的AI行业安全机构。他日益投入推动为通用人工智能制定安全机制与最佳实践,并将该拟议机构比作国际原子能机构。
据《金融时报》,Anthropic投资者预计其或于今年10月启动IPO,目标估值2万亿美元以上,有望超过SpaceX的1.77万亿美元,成为史上最大IPO。公司营收高速增长,预计到2026年底年化营收达1000亿至1200亿美元,增幅超10倍;今年5月已突破470亿美元。
韩国Upstage推出商用大模型Solar Pro4,具备512K上下文窗口,最高支持128K输出,单次会话可处理多份合同、报告及数据文件。定价颇具竞争力:每百万Tokens输入0.3美元,缓存读取0.06美元,输出1.2美元。
亚特兰大联储调查显示,约九成企业高管认为AI尚未提高公司生产力。2021年以来生产力提升主要源于疫情远程办公红利,而非AI。企业押注裁员与投资AI,逻辑是AI可减员增效,但现实数据并不支持,研究交叉分析美国上市公司亦未证实该假设。
据《连线》报道,美国前沿AI模型网络安全审查目前仅针对闭源模型,知情人士称未来数月“几乎肯定”扩展至开源模型。“前沿”指能力比肩Anthropic Claude Mythos或OpenAI GPT-5.6的模型,暂无更具体版本说明。该审查框架仍为自愿性质,部分官员担心强制审查或抑制AI发展。

关注 “悠AI” 更多干货技巧行业动态