看汇

上海AI实验室开源发布高质量语料“万卷CC”

近日,上海人工智能实验室上海AI实验室)发布新一代高质量大模型预训练语料“万卷CC”WanJuan-CC),首批开源的语料覆盖过去十年互联网上的公开内容,包含1千亿字符100Btoken),约400G ...

警惕!“美企竟这样绕过禁令,偷拿中国关键矿物”

【文/观察者网 柳白】面对中国依国际惯例执行的关键矿物管制,一些美西方买家叫苦不迭,甚至动起歪脑筋。路透社7月9日报道披露,为绕过中方管制,有美国买家通过第三国转运拿到了矿物。比如根据海关和航运记录, ...

大模型「点火」,AI for Science 提速

在生产环节中,95% 是一个分水岭。以人为对照标准,人工的准确率在 92% 至 98% 之间,因此,行业对机器容忍度的判别标准取之中位数,未达到 95% 的部分,无论是 80% 乃至 90% 的准确率 ...

多模态AI技术「涌现」,AI公司的「新机会」

ChatGPT-4的横空出世,让AI行业再一次柳暗花明。某AI企业人士如此评价GPT-4的进步:“GPT-3或3.5像一个六年级学生,而GPT-4像一个聪明的十年级学生。”即将毕业的小学生与新晋高中生 ...

人大 Sora 思辩:Sora 到底懂不懂物理世界?

Sora 发布至今,虽然仍未正式对外开放,但对其技术细节、切实影响的讨论从未停歇。讨论的背后,是为了探索人工智能的更本质问题。对旧有视觉生成思路的检验和校正,是 Sora 带来的直观影响。在此基础上, ...