Mit der rasanten Entwicklung künstlicher Intelligenz ist der Mangel an hochwertigen Schulungsdaten nach und nach zu einem wichtigen Engpass-Einschränkungs-Fortschritt der Branche, und die Datenannotationsindustrie kann starke Impulse für die innovative Entwicklung künstlicher Intelligenz bieten. Die nationale Entwicklungs- und Reformkommission, die nationale Datenverwaltung, das Finanzministerium und das Ministerium für Humanressourcen und soziale Sicherheit haben gemeinsam die "Meinungen zur Förderung der hochwertigen Entwicklung der Datenkennzeichnungsindustrie" (im Folgenden als "Meinungsmeinungen der Implementierung bezeichnet" bezeichnet. und die jährliche Verbindungswachstumsrate wird 20%überschreiten.
Wie hoch ist die aktuelle Situation der chinesischen Datenannotationsindustrie? Was sind die "Schwellenwerte", die für die qualitativ hochwertige Entwicklung der Datenannotationsindustrie gekreuzt werden müssen? Als Reaktion auf diese Themen führten Reporter von Science and Technology Daily Interviews.
Rohdaten werden zu verfügbaren Ressourcen
Einfach ausgedrückt, der Prozess der Ausbildung künstlicher Intelligenz Big Models ist wie ein Lehrer, der den Schülern das Lesen beibringt. "Zhang Tong, Vize -Dekan der School of Information und Engineering an der South China University of Technology, erklärte lebhaft, dass Datenanmerkungen zum" Beschriftung "oder" markieren "oder" markieren "werden müssen, um die Beschriftungen der einzelnen Daten zu erklären, und die entsprechenden Aufgaben entsprechenden Aufgaben, die zum Bigmodell ausgeführt werden. schnell und effizient trainieren und die Genauigkeits- und Generalisierungsfähigkeit großer Modelle erheblich verbessern.
Während der Ausbildung von ChatGPT investierte das Open Artificial Intelligence Research Institute (OpenAI) in den Vereinigten Staaten eine erhebliche Menge an Ressourcen in Datenanmerkungen. Um eine qualitativ hochwertige Erfüllung von Annotationsaufgaben zu gewährleisten, ermöglichen OpenAI ChatGPT, menschliche Anweisungen besser zu verstehen und die Genauigkeit und Zuverlässigkeit großer Modelle sicherzustellen, zahlreiche "Lehrer". Diese "Lehrer" decken sowohl allgemeine Datenanmerkungen als auch Fachkräfte sowie Experten für Doktoranden ab.
Die Datenannotation ist einer der Kernwecker für die Entwicklung künstlicher Intelligenz. Die Datenannotationsindustrie ist eine aufstrebende Branche, die Daten durch Screening, Reinigung, Klassifizierung, Annotation, Kennzeichnung und Qualitätsprüfung verarbeitet. Seine Kernaufgabe besteht darin, Rohdaten in hochwertige Rohstoffe zu verarbeiten, die zum Ausbilden von künstlichen Intelligenzmodellen verwendet werden können. "Zhang Tong führte vor, dass Datenanmerkungen als entscheidender Bestandteil des Trainings großer Modelle die Leistung von Modellen des maschinellen Lernens direkt beeinflussen und eine wichtige Rolle bei der Unterstützung der Verbesserung der Fähigkeiten für künstliche Intelligenz spielen.
Nach Ansicht von Zhang Tong sind unverarbeitete Rohdaten nur eine potenzielle Ressource, während Daten, die annotiert und verarbeitet wurden, effektiv auf dem Markt gehandelt und verteilt werden können, wodurch der Wert von Datenelementen vollständig ausgelöst wird. Die Kultivierung und Stärkung der Datenannotationsindustrie ist wichtig, um die Qualität der Datenversorgung zu verbessern und die innovative Entwicklung künstlicher Intelligenz zu fördern.
Branchenkenner sind der Ansicht, dass die Datenannotationsindustrie, die weiterhin reifen und ihre Anwendungsbereiche weiter ausbauen, ein breiterer Marktbereich einleiten wird, insbesondere in aufstrebenden Technologiebereichen wie der Wirtschaft mit geringer Höhe, intelligenten Städten, autonomem Fahren und intelligenter Gesundheitswesen, die ein enormes Potenzial zeigen.

Die Branche hat in ein Stadium der schnellen Entwicklung eingetreten
Der globale Markt für Datenanmerkungen befindet sich derzeit in einem Zeitraum von schnellem Wachstum. In den letzten Jahren hat die chinesische Datenannotationsindustrie in eine Phase der raschen Entwicklung eingetreten, wobei die industrielle Kette kontinuierlich verbessert und technologische Innovationsleistungen marktorientierte Anwendungen realisiert. Schätzungen zufolge wird das Ausmaß der chinesischen Datenannotationsindustrie bis 2023 rund 80 Milliarden Yuan erreichen.
Sieben Städte, darunter Chengdu in Sichuan, Shenyang in Liaoning, Hefei in Anhui und Changsha in Hunan, die die Aufgabe des Aufbaus von Datenannotationsbasen erbracht haben, haben erhebliche Durchbrüche in Bereichen wie großem Maßstabmodellanschlag und automatisierter Annotation erzielt. Als erste Stapel von Datenanmerkungen in Changsha hat der Changsha Information Industry Park mehr als 10000 verschiedene digitale Unternehmen wie intelligente vernetzte Fahrzeuge, Datenanmerkungen und Netzwerksicherheit angezogen, um sich in der Lage zu halten, eine künstliche Innovence Innovation Center -Power -Service -Plattform für Innovation Center zu schaffen.
Guangdong fördert aktiv den Pilot- und Basiskonstruktion von Datenannotationstraining und bietet solide Datenunterstützung für das großflächige Modelltraining. Im September 2023 wurde das Pilotprogramm für öffentliche Datenannotationstrainings in der Provinz Guangdong offiziell gestartet. Auf der Guangdong Public Data Kennzeichnung (Qingyuan) haben eine Gruppe ausstehender Unternehmen in den Bereichen autonomer Fahren und öffentliche Kennzeichnungen der Regierung, wie Baidu, Yanhu -Technologie und Haosida, die Führung in der Beilegung von Inszenierungen übernommen. Mit der treibenden Kraft der führenden Unternehmen und der agglomerierenden Wirkung der digitalen Wirtschaftsbranche, der Dateiantriebsbranche, der Diener -Industrie, ist die Dateiannotage -Industrie.
"Wir betrachten die Branche der digitalen Wirtschaft als Kern, arbeiten eng mit den führenden Unternehmen der digitalen Wirtschaftsbranche zusammen und verpflichten uns, einen nationalen Datenannotationsindustrie -Cluster und eine Demonstrationszone für die Integration der Branchenausbildung aufzubauen." Li Yankang, die für die Annotationsbasis von Guangdong zuständige Person (Qingyuan), stellte vor, dass die Baidu AI Cloud (Qingyuan) künstliche Intelligenz grundlegende Daten Industriebasis, die hier begangen hat, insgesamt 5 inkubierte Datenanmerkungen eingeführt und mehr als 300 professionelle Annotatoren kultiviert haben. In Zukunft wird die Basis weiterhin hervorragende Datenannotationsunternehmen anbauen und inkubieren und das kontinuierliche Wachstum und die Entwicklung der Datendienstbranche von Qingyuan fördern.
