{主关键词}

一 | “画面显示现场搭设有金属管脚手架,脚手架上有一名佩戴红色安全帽的人员,安全防护多处缺失。

二 |
天呢,距离上次 Anthropic 的 Sonnet 5.5 模型泄露才过了十几天,就又有两个新模型出现了,这帮人不休息的吗?消息一经曝出,迅速引发社区讨论,多位开发者在 API 访问和 Discord 中确认了这两个代号的存在。从曝光的代号后缀eap(Early Access Program,早期访问计划)来看,这两款模型目前仍处于内部测试阶段,仅对少量开发者开放。
三 | 脚手架下方地面堆放有钢管、扣件等物料,左下角可见两名佩戴白色安全帽的人员站立,背景可见混凝土墙体结构。

四 | ”这是在杭州一工地抓拍的现场画面,但就在快门按下的瞬间,一个看不见的“安全监管员”完成了对这张照片的“审阅”——脚手架搭设不合规、高处作业未系跨安全带、高处作业吊篮不规范,三条隐患同步弹出,整改指令随即下发。几个关键信息点:两个代号均不属于 Fable 级别,社区普遍推测它们将作为 Opus 或 Sonnet 产品线的更新发布,也有人猜测可能包含新一代 Haiku早期测试者反馈,Marshmallow 的表现优于 Melon更引人关注的是,似乎 Marshmallow 的对话体验已经超越了当前的 Opus 5
作为参考,Opus 5 于 7 月 24 日发布,距今刚好一个月;Sonnet 5 发布于 6 月 30 日。

五 | 如果新模型确实即将推出,Anthropic 的迭代节奏将进一步加快。这位“安全监管员”,就是浙江蓝宸数联科技有限公司打造的AI建安智检平台。“过去,工地安全巡检主要靠人,特别是对于一些隐患识别,还得看老师傅的经验。但人总有局限,不能时时刻刻盯着,像外立面、深基坑、高边坡这些‘难以一眼看清的角落’,往往是事故的高发区。Anthropic 这次的模型内部命名风格也发生了改变。

六 | ”蓝宸数联董事长魏自金曾在城建领域深耕十余年,对此深有感触。Anthropic 的公开模型一直沿用文学体裁命名:Haiku(俳句)、Sonnet(十四行诗)、Opus(大型乐章)、Fable(寓话)、Mythos(神话)。而内部开发代号此前被曝使用动物名称,就比如 Sonnet 5.5 的曝光模型的内部名称为Fennec(一种沙漠狐)。而如今人工智能的应用,让巡检效率有了质的提升。AI建安智检平台将工地划分为巡检网格,联动球机、无人机、机器狗、执法记录仪等设备,开展空天地一体主动巡检,依托自主研发的AI智能体驱动,可以实现从自动抓拍、AI识别、分级派单到整改复核、线上闭环的全流程数字化管控。这次出现的Marshmallow(棉花糖)和Melon(甜瓜)显然转向了食物主题。

七 | 目前,平台已覆盖14大类、46大重点隐患类型、140余类安全隐患,语义描述准确率达98.21%,平均AI隐患识别准确率不低于86%,处于行业领先水平。代号本身不能说明太多,但命名体系的切换或许暗示这一批模型在内部归属于一个新的开发分支。

八 | 这些成效斐然的数字背后,其实有本不断更新的“教科书”在支撑——工地安全隐患高质量数据集,它让AI不仅能“看到”,更能“看懂”。“数据集不是数据的简单搜集,而是带有成效逻辑的完整链条,包括采集、标注、分析、闭环四个环节。”魏自金解释,以基坑为例,拍照只是第一步,接下来要从土堆的高度、坡度、湿度、行业规范等多个维度进行综合分析,判断是否存在滑坡风险。

九 | 发现隐患后还要派单、整改、复查,直到确认闭环。而这精准研判、举一反三的能力,来自日复一日的高强度训练。
有分析指出,Anthropic 今年每隔大约两周就会推出一次重要更新。如果棉花糖和甜瓜已经进入 EAP 阶段,正式发布可能就在下个月。当然,内部测试代号出现在 API 中,并不等于产品已经定型。代号可能被重命名、合并,甚至取消。记者了解到,蓝宸数联的数据来源非常广泛,监管数据、项目数据、施工企业数据都在不断“喂”给AI建安大模型。不仅如此,团队还会主动“投喂”一些错误数据,倒逼模型练就一双“火眼金睛”。但考虑到当前大模型竞争的白热化程度,Anthropic 显然没有放慢脚步的打算。

十 |
Current article:http://euj1jt5.cuancuguanzhongnieqinyazhun.cyou/a5s/20260826/49306.html
Published on:07:15:24
我的网站热门国内