开云(中国)Kaiyun·官方网站 - 登录入口IT之家征引博文先容-开云kaiyun在线·(2024已更新(最新/官方)

IT之家 11 月 16 日音书,科技媒体 golem 昨日(11 月 15 日)发布博文,报说念称谷歌通过其 AI Studio 平台,正测试一款尚不决名的 AI 模子,在破译难以辨别的历史手稿方面已接近东说念主类巨匠的水平。
IT之家征引博文先容,历史学家 Mark Humphries 使用一套稀罕成立的基准数据集,系统性地测试了该模子的性能。恶果标明,在处分五份高难度历史手稿时,该模子的举座字符诞妄率约为 1.7%,其中大部分诞妄触及标点象征和大小写,而非单词自己。
Humphries 的评估进一步指出,如若摒除暧昧的标点象征和大小写诞妄,该 AI 模子的字符诞妄率将骤降至约 0.56%,格外于每转写 200 个字符才出现一个诞妄。
左证新发现的未知 Gemini 型号转录的奥尔巴尼账簿页面
这一惊东说念主的准确度,让其性能足以与从事历史文件转写的专科东说念主类责任者等量皆不雅。这次测试的文档涵盖了 18 至 19 世纪的多种手写立场,其中不乏笔迹倨傲、拼写诞妄和语法不一致的复杂样本,进一步突显了该模子的纷乱智商。
张开剩余47%该模子最令东说念主有时的泄露,是其卓越了简便的笔墨转写,展现出复杂的推奢睿商。在处分一份 18 世纪商东说念主的日志时,原文中有一条对于购买糖的纪录,仅标记了数字“145”,并未注明计量单元。
谷歌的 AI 模子并未径直转写为“145”,而是输出了“14 磅 5 盎司”。推敲东说念主员发现,AI 是通过反向谈论账本中纪录的总价,并集中其时英国的货币(磅、先令、便士)与分量单元相干,才成功臆想出这一恶果。
尽管初步恶果令东说念主昂然,但 Humphries 也强调了现时评估的局限性。由于该模子通过 A/B 测试格局稀薄出现,系统性地进行大领域测试存在难题,当今仅评估了基准数据蚁合约 10% 的样本。
发布于:山东省