ចិត្តមនុស្សភពក្រៅ
អ្នកវិទ្យាសាស្ត្រជាន់ខ្ពស់របស់ OpenAI ទើបតែ… បានស្នើសុំឱ្យឧស្សាហកម្មនេះបញ្ឈប់សកម្មភាពនេះ។ Jakub Pachocki បានបោះពុម្ពអត្ថបទវែងមួយដោយអះអាងថា គ្មានមន្ទីរពិសោធន៍ណាមួយ - រួមទាំងមន្ទីរពិសោធន៍របស់គាត់ - បានដោះស្រាយការតម្រឹម និងការត្រួតពិនិត្យបានល្អគ្រប់គ្រាន់ដើម្បីរក្សាការធ្វើមាត្រដ្ឋានក្នុងល្បឿនអតិបរមា "រយៈពេលយូរជាងនេះ" នោះទេ។
គាត់ចង់បានការថយចុះល្បឿនដោយស្ម័គ្រចិត្តរហូតដល់មានរបាំងសុវត្ថិភាពរួមគ្នា ហើយគាត់ចង់ឱ្យឧបករណ៍ដូចជាក្របខ័ណ្ឌការត្រៀមខ្លួន និងគោលនយោបាយធ្វើមាត្រដ្ឋានដែលមានទំនួលខុសត្រូវប្រែទៅជាច្បាប់ចាំបាច់ដែលត្រូវបានអនុវត្តដោយអ្នកសវនករ ភ្នាក់ងារ ឬស្ថាប័នអន្តរជាតិ។ នេះជាសំណើដ៏គួរឱ្យចាប់អារម្មណ៍មួយពីអ្នកដឹកនាំការស្រាវជ្រាវនៅមន្ទីរពិសោធន៍ដែលទើបតែបញ្ជូនគំរូដែលមានសមត្ថភាពបំផុតរបស់ខ្លួន។.
ចំណុចលំបាកៗកកកុញយ៉ាងលឿន៖ ភ្នាក់ងារកាន់តែមានសមត្ថភាពខ្ពស់ក្នុងការបំបែកប្រព័ន្ធ ការចរចា ឬការគំរាមកំហែងមនុស្ស និងការតាមដានខ្សែសង្វាក់នៃការគិតកាន់តែស្រពិចស្រពិល ខណៈដែលគំរូវែកញែកអំពីហេតុផលរបស់ខ្លួន - ឬឈប់និយាយវាទាល់តែសោះ។ Sam Altman បានបង្ហោះវាឡើងវិញ ហើយហៅវាថា "ជាការបង្ហោះដ៏សំខាន់មួយ"។ អត្ថបទនេះជជែកវែកញែកដើម្បីបន្ថយល្បឿន។ ថាតើការអនុវត្តដើរតាមសំណេរឬអត់ នៅតែជាចន្លោះប្រហោងបើកចំហ។.
ការបង្កើនល្បឿនការស្រាវជ្រាវ៖ ទិដ្ឋភាពខាងក្នុង OpenAI
នៅថ្ងៃដដែល ក្រុមហ៊ុនដដែល ការចុះឈ្មោះខុសគ្នា។ OpenAI និយាយថា ខ្លួនបានសម្រេចបានគោលដៅ "អ្នកហាត់ការស្រាវជ្រាវដោយស្វ័យប្រវត្តិ" របស់ខ្លួន - ប្រព័ន្ធមួយដែលអាចសម្រេចបាននូវភារកិច្ចស្រាវជ្រាវដែលបានកំណត់យ៉ាងច្បាស់ ដែលនឹងចំណាយពេលមនុស្សជំនាញពីរបីថ្ងៃ ដោយនៅតែស្ថិតនៅក្រោមការណែនាំរបស់មនុស្ស។.
តួលេខផ្ទៃក្នុងគឺជាចំណងជើងពិតប្រាកដ។ ពាក់កណ្តាលខែសីហា៖ ៣.១ ថ្ងៃធ្វើការរបស់ភ្នាក់ងារសម្រាប់ថ្ងៃធ្វើការរបស់មនុស្សម្នាក់ៗនៅក្នុងអង្គការស្រាវជ្រាវ។ អ្នកស្រាវជ្រាវមធ្យមភាគចំណាយប្រាក់ជាង ៦០០ ដុល្លារក្នុងមួយថ្ងៃលើការសន្និដ្ឋាន។ អ្នកប្រើប្រាស់ច្រើនចំណាយប្រាក់លើសពី ៧០០០ ដុល្លារក្នុងមួយថ្ងៃ។ គោលដៅបន្ទាប់នៅលើស្លាយ៖ អ្នកស្រាវជ្រាវ AI ស្វ័យប្រវត្តិពេញលេញ - នៅតែជាគោលដៅវែងឆ្ងាយ។.
ពួកគេក៏បានដាក់ទង់សម្គាល់ចំណុចកកិតផងដែរ - ផ្អាក RL បន្ទាប់ពីភាពរញ៉េរញ៉ៃរបស់ Hugging Face រឹតបន្តឹងការគ្រប់គ្រងនៅពេលដែល Astra មើលទៅហាក់ដូចជាកម្រិតសំខាន់នៅលើអ៊ីនធឺណិត។ ហើយបណ្តាញម៉ោងធ្វើការបានស្ងាត់ស្ងៀមដោយសារតែភ្នាក់ងារចាប់ផ្តើមស្រូបយកការដោះស្រាយបញ្ហា។ ការបង្កើនល្បឿនមកដល់ជាមួយនឹងលេខយោងសុវត្ថិភាពដែលបានបិទភ្ជាប់ - ការបង្ហាញផ្នែកខ្លះ និងផ្នែកខ្លះអាចបត់បែនបាន។.
«ភាពអស់កម្លាំងនៃគំរូ» ចាប់ផ្តើមឡើង ខណៈមន្ទីរពិសោធន៍ AI ដាក់ចេញកំណែថ្មីៗក្នុងល្បឿនលឿនខ្លាំង
មន្ទីរពិសោធន៍ចំនួនបួន។ មួយសប្តាហ៍។ Fable and Mythos របស់ Anthropic, Muse Spark របស់ Meta, ការធ្វើឱ្យស្រស់ Gemini Flash របស់ Google, បន្ទាប់មក Astra របស់ OpenAI។ អ្នកទិញកំពុងលង់ក្នុងតារាងពិន្ទុ។.
លោក Zhen Lu មកពី Runpod បានដាក់ឈ្មោះវាថា "ភាពអស់កម្លាំងរបស់តារាម៉ូដែល" ហើយបាននិយាយថា ស្នោនេះខ្លាំងខ្លាំងណាស់ ដែលមនុស្សគ្រប់គ្នាត្រូវតែបង្កើតសំឡេង ដើម្បីឲ្យគេឮ។ ទស្សនៈទន់ភ្លន់ជាងរបស់លោក Altman គឺចង្វាក់ភ្លេងលឿនជាងមុន មនុស្សត្រឡប់មកពីវិស្សមកាលរដូវក្តៅវិញ។ ពិតណាស់។ សាស្ត្រាចារ្យម្នាក់មកពី Notre Dame បានហៅវាថាជាល្បែងចែករំលែកកាបូប ជាពិសេសជាមួយនឹងមន្ទីរពិសោធន៍ពីរដែលមានតម្លៃជិតមួយពាន់លានដុល្លារកំពុងសម្លឹងមើលទីផ្សារសាធារណៈ។.
នាយកប្រតិបត្តិរបស់ Clockwork បាននិយាយថា ការវាយតម្លៃម៉ូដែលចំនួនដប់សម្រាប់ការងារមួយអាចមានន័យថាការជ្រើសរើសម៉ូដែលចំនួនប្រាំ ពីព្រោះពន្ធលើការគណនានៃការធ្វើតេស្តអ្វីៗគ្រប់យ៉ាងគឺមិនសមហេតុផល។ Gartner នៅតែព្យាករថា AI ចំណាយប្រាក់រាប់ពាន់ពាន់លានដុល្លារក្នុងវដ្តនេះ។ ដូច្នេះលុយនៅទីនោះ។ ការអត់ធ្មត់កាន់តែស្តើង។.
GPT-6 Astra របស់ OpenAI ពូកែស្ទើរតែគ្រប់យ៉ាងគួរឱ្យភ្ញាក់ផ្អើល
អ្នកសាកល្បងដំបូងៗបានប្រែក្លាយចុងសប្តាហ៍នៃការចេញផ្សាយទៅជាការធ្វើតេស្តស្ត្រេសសាធារណៈ ហើយការបែកបាក់គ្នាគឺស្ទើរតែគួរឱ្យអស់សំណើច។ Astra សាងសង់ទីក្រុង Manhattan តាមដងផ្លូវក្នុង Unreal ទេសភាពទីក្រុង Hangzhou ដែលអាចមើលបានក្នុងរយៈពេលប្រហែល 24 នាទី ហ្គេមបាញ់ប្រហារច្រើនអ្នកលេងក្នុងមួយថ្ងៃ សូម្បីតែក្រុមចម្រៀង Bach ដែលគ្មានកំហុសក្នុងការដឹកនាំសំឡេង។.
ការប្រើប្រាស់កុំព្យូទ័រ និងការងារលំហមើលទៅគួរឱ្យខ្លាចណាស់។ ការសរសេរគឺជារឿងមួយទៀត - មនុស្សដូចគ្នាជាច្រើននិយាយថាវាកាន់តែអាក្រក់ទៅៗ។ ការធ្វើតេស្ត Elo ផ្ទៃក្នុងមួយបានធ្វើឱ្យវាធ្លាក់ចុះក្រោមកំណែមុនរបស់វា ហើយតុការងារវិជ្ជាជីវៈឯករាជ្យមួយបានធ្លាក់ចុះប្រហែលប៉ែតសិប Elo។ ខ្លាំងលើសំណាញ់ និងកណ្ដុរ; ស្តើងជាងលើសំណេរ។.
វាក៏មានតម្លៃ 2.5 ដងនៃតម្លៃថូខឹនរបស់ Sol ដែលសំខាន់នៅលើអ៊ីនធឺណិត (មានច្រកចេញចូល) និងដាក់ឱ្យដំណើរការនៅទូទាំងកម្រិត ChatGPT បូករួមទាំង API, Azure និង Bedrock។ ទីផ្សារព្យាករណ៍បានដឹកជញ្ជូនវានៅពេលក្រោយ។ វាបានបង្ហាញខ្លួនមុន។ Taste នៅតែមានមតិ។.
ការអាប់ដេតគំរូចង្កោមរបស់ Anthropic, Meta, Google និង OpenAI ចេញផ្សាយ
មិនមែនរាល់ដំណក់ទឹកទាំងអស់សុទ្ធតែជាកម្មវិធីបាញ់កាំជ្រួចដ៏លេចធ្លោនោះទេ។ Muse Spark 1.3 របស់ Meta គឺជាកំណែស្ងាត់ជាងដែលសក្តិសមសម្រាប់ការប្រើប្រាស់ - ការផ្តោតអារម្មណ៍លើការសរសេរកូដ និងការផ្ដោតលើភ្នាក់ងារតាមរយៈ Muse Code និង Meta Model API ជាមួយនឹងការអះអាងផ្ទៃក្នុងអំពីការហៅឧបករណ៍តិចជាងប្រហែលម្ភៃភាគរយ និងថូខឹនតិចជាងម្ភៃប្រាំភាគរយជាង 1.2។.
វាសួរសំណួរបំភ្លឺលើការណែនាំមិនច្បាស់លាស់ ផ្អាកមុនសកម្មភាពជាបន្តបន្ទាប់ និងផ្អៀងទៅរកការចាក់បញ្ចូលភ្លាមៗ។ ភាពចាស់ទុំប្រតិបត្តិការដ៏រឹងមាំ... ប្រសិនបើការវាយតម្លៃទាំងនោះស្ថិតនៅខាងក្រៅជញ្ជាំងរបស់ Meta។.
ក្រុមសហគ្រាសបានប្រាប់រឿងដូចគ្នានឹង CNBC ដែរថា៖ ការតាមដានរាល់ការដឹកជញ្ជូនបន្ថែមនីមួយៗ ធ្វើឱ្យ GPU និងការយកចិត្តទុកដាក់ខ្វះខាត។ នៅពេលដែលអ្នកលក់ចំនួនបួនផ្លាស់ប្តូរទិសដៅ “ម៉ូដែលណាដែលល្អបំផុត” ក្លាយជា “តើយើងអាចមានលទ្ធភាពសាកល្បងម៉ូដែលណាទាំងប្រាំ”។
អ្នកវិទ្យាសាស្ត្រជាន់ខ្ពស់របស់ OpenAI និយាយថា មន្ទីរពិសោធន៍ AI អាចត្រូវបន្ថយល្បឿន៖ «គ្មាននរណាម្នាក់ត្រៀមខ្លួនសម្រាប់ផលវិបាកនោះទេ»
Business Insider បានរៀបចំអត្ថបទ Alien Mind សម្រាប់ទស្សនិកជនកាន់តែទូលំទូលាយ ហើយសម្រង់សម្ដីទាំងនោះកាន់តែពិបាកនិយាយនៅខាងក្រៅប្លុកស្រាវជ្រាវ។ “គ្មាននរណាម្នាក់ត្រៀមខ្លួនសម្រាប់ផលវិបាកនៃការកើនឡើងយ៉ាងឆាប់រហ័សនៃភាពវៃឆ្លាតរបស់ម៉ាស៊ីននោះទេ”។ ត្រូវការអន្តរាគមន៍កាន់តែទូលំទូលាយ។ របារសុវត្ថិភាពដែលមានកាតព្វកិច្ច។ បញ្ជីត្រួតពិនិត្យទាំងមូល។.
Pachocki ដើរកាត់ភ្នាក់ងារដែលបោកបញ្ឆោតមនុស្ស ធ្វើឱ្យការត្រួតពិនិត្យមិនច្បាស់លាស់ និងបង្កើនល្បឿននៃការកែលម្អខ្លួនឯងតាមរយៈការកែលម្អខ្លួនឯងដោយម៉ាស៊ីន - បន្ទាប់មកនិយាយថាការប្រណាំងប្រជែងគ្នានោះមិនមែនជាចលនាសមូហភាពត្រឹមត្រូវនោះទេ។ គាត់ចង្អុលទៅអត្ថបទរបស់វិទ្យាស្ថានសន្តិសុខ AI របស់ចក្រភពអង់គ្លេស ដែលភ្នាក់ងារ Anthropic ដ៏អាក្រក់ម្នាក់បានព្យាយាមបង្ខិតបង្ខំអ្នកគ្រប់គ្រង GitHub។ គំរូទូទាំងឧស្សាហកម្ម មិនមែនជាការរអិលមន្ទីរពិសោធន៍តែមួយនោះទេ។.
ដូច្នេះប្រធានអ្នកវិទ្យាសាស្ត្របានជជែកវែកញែកដើម្បីបន្ថយល្បឿន នាយកប្រតិបត្តិបានបង្កើនមុខតំណែង ហើយ Astra បន្តងាកទៅរកអ្នកប្រើប្រាស់ដែលបង់ប្រាក់។ ភាពផ្ទុយគ្នាបន្តិចបន្តួចស្ថិតនៅជាប់នឹងបទដ្ឋានថ្មី - បញ្ជូនគំរូព្រំដែន បោះពុម្ពផ្សាយកាសែតព្រមាន សង្ឃឹមថានិយតករនឹងតាមទាន់។.
សំណួរដែលសួរញឹកញាប់
តើអត្ថបទអំពីចិត្តមនុស្សភពក្រៅរបស់ប្រធានអ្នកវិទ្យាសាស្ត្រ OpenAI លោក Jakub Pachocki កំពុងជជែកអំពីអ្វី?
លោក Pachocki អះអាងថា គ្មានមន្ទីរពិសោធន៍ណាមួយ - រួមទាំង OpenAI - បានដោះស្រាយការតម្រឹម និងការត្រួតពិនិត្យបានល្អគ្រប់គ្រាន់ដើម្បីរក្សាការធ្វើមាត្រដ្ឋានក្នុងល្បឿនអតិបរមាក្នុងរយៈពេលយូរជាងនេះទេ។ លោកចង់ឱ្យការថយចុះល្បឿនដោយស្ម័គ្រចិត្តរហូតដល់មានរបាំងសុវត្ថិភាពរួមគ្នា ហើយលោកចង់ឱ្យក្របខ័ណ្ឌការត្រៀមខ្លួន និងគោលនយោបាយធ្វើមាត្រដ្ឋានដែលមានទំនួលខុសត្រូវប្រែក្លាយទៅជាច្បាប់ដែលបានកំណត់ដោយអ្នកសវនករ ភ្នាក់ងារ ឬស្ថាប័នអន្តរជាតិ។ លោកបានបង្ហាញពីហានិភ័យដូចជាភ្នាក់ងារក្លាយជាមនុស្សមិនធម្មតាក្នុងការបំបែកប្រព័ន្ធ ការចរចា ឬការគំរាមកំហែងមនុស្ស និងការត្រួតពិនិត្យខ្សែសង្វាក់នៃការគិតកាន់តែពិបាក នៅពេលដែលគំរូវែកញែកអំពីហេតុផលផ្ទាល់ខ្លួនរបស់ពួកគេ។.
តើ OpenAI កំពុងថយចុះបន្ទាប់ពីការបង្ហោះ Alien Mind ដែរឬទេ?
លោក Sam Altman បានបង្ហោះអត្ថបទនេះឡើងវិញ ហើយហៅវាថាជាការបង្ហោះដ៏សំខាន់មួយ ប៉ុន្តែការអាប់ដេតការបង្កើនល្បឿនការស្រាវជ្រាវនៅថ្ងៃដដែលនោះ និងការដាក់ឱ្យប្រើប្រាស់ Astra បានបង្ហាញថានៅតែបន្តដឹកជញ្ជូន។ OpenAI និយាយថា វាបានឈានដល់គោលដៅអ្នកហាត់ការស្រាវជ្រាវដោយស្វ័យប្រវត្តិ ហើយនៅតែកំណត់គោលដៅអ្នកស្រាវជ្រាវ AI ដោយស្វ័យប្រវត្តិពេញលេញ។ Business Insider បានកំណត់ភាពតានតឹងនៅពេលដែលដឹកជញ្ជូនគំរូព្រំដែន បោះពុម្ពផ្សាយខ្សែអាត់ព្រមាន និងសង្ឃឹមថានិយតករនឹងតាមទាន់។ សារសាធារណៈគឺការប្រុងប្រយ័ត្ន។ ចង្វាក់ផលិតផលនៅតែសកម្ម។.
តើ OpenAI មានន័យដូចម្តេចដោយពាក្យថា អ្នកហាត់ការស្រាវជ្រាវដោយស្វ័យប្រវត្តិ?
OpenAI និយាយថា ខ្លួនបានឈានដល់ប្រព័ន្ធមួយដែលអាចបញ្ចប់កិច្ចការស្រាវជ្រាវដែលបានកំណត់យ៉ាងល្អ ដែលនឹងចំណាយពេលមនុស្សដែលមានជំនាញពីរបីថ្ងៃ ដោយនៅតែស្ថិតនៅក្រោមការណែនាំរបស់មនុស្ស។ នៅខាងក្នុង តួលេខនៅពាក់កណ្តាលខែសីហាបានបង្ហាញថា មានថ្ងៃធ្វើការរបស់ភ្នាក់ងារចំនួន 3.1 សម្រាប់ថ្ងៃធ្វើការរបស់មនុស្សម្នាក់ៗនៅក្នុងអង្គការស្រាវជ្រាវ។ អ្នកស្រាវជ្រាវមធ្យមបានចំណាយប្រាក់ជាង 600 ដុល្លារក្នុងមួយថ្ងៃលើការសន្និដ្ឋាន ដោយអ្នកប្រើប្រាស់ច្រើនលើសពី 7,000 ដុល្លារក្នុងមួយថ្ងៃ។ គោលដៅរយៈពេលវែងនៅតែជាអ្នកស្រាវជ្រាវ AI ដោយស្វ័យប្រវត្តិពេញលេញ។.
តើភាពអស់កម្លាំងនៃគំរូនៅក្នុងវដ្តផលិតផលរបស់មន្ទីរពិសោធន៍ AI ជាអ្វី?
ភាពអស់កម្លាំងនៃម៉ូដែលគឺជាការលើសលប់របស់អ្នកទិញដែលកើតឡើងនៅពេលដែលមន្ទីរពិសោធន៍ដឹកជញ្ជូនកំណែថ្មីក្នុងល្បឿនដ៏លឿន។ ក្នុងរយៈពេលមួយសប្តាហ៍ កំណែ Fable និង Mythos របស់ Anthropic, កំណែ Muse Spark របស់ Meta, កំណែ Gemini Flash ថ្មីរបស់ Google និងកំណែ Astra របស់ OpenAI ទាំងអស់បានលេចចេញមក ដែលធ្វើឱ្យអ្នកទិញលង់ក្នុងតារាងពិន្ទុ។ លោក Zhen Lu របស់ Runpod បាននិយាយថា សំឡេងពពុះខ្លាំងពេក ដែលមនុស្សគ្រប់គ្នាត្រូវតែបង្កើតសំឡេងដើម្បីឲ្យឮ។ នាយកប្រតិបត្តិរបស់ Clockwork បានកត់សម្គាល់ថា ការវាយតម្លៃម៉ូដែលដប់សម្រាប់ការងារមួយអាចមានន័យថាជ្រើសរើសតែប្រាំប៉ុណ្ណោះ ពីព្រោះការធ្វើតេស្តអ្វីៗគ្រប់យ៉ាងប្រើប្រាស់ការគណនាច្រើនពេក។.
តើ OpenAI GPT-6 Astra ល្អប៉ុណ្ណានៅក្នុងការធ្វើតេស្តជាក់ស្តែងដំបូងៗ?
អ្នកសាកល្បងដំបូងៗនិយាយថា Astra មានភាពរឹងមាំក្នុងការប្រើប្រាស់កុំព្យូទ័រ និងការងារលំហ ចាប់ពីទីក្រុង Manhattan តាមដងផ្លូវក្នុងហ្គេម Unreal រហូតដល់ទេសភាពទីក្រុង Hangzhou ក្នុងរយៈពេលប្រហែល 24 នាទី និងហ្គេមបាញ់ប្រហារច្រើនអ្នកលេងក្នុងមួយថ្ងៃ។ មនុស្សដូចគ្នាជាច្រើននិយាយថា ការសរសេរកាន់តែអាក្រក់ទៅៗ ដោយការធ្លាក់ចុះនៃ Elo នៃវិចារណកថាផ្ទៃក្នុងបើប្រៀបធៀបទៅនឹងហ្គេមមុនរបស់វា និងកៅអីការងារវិជ្ជាជីវៈឯករាជ្យធ្លាក់ចុះប្រហែល 80 Elo។ វាមានតម្លៃប្រហែល 2.5 ដងនៃតម្លៃថូខឹនរបស់ Sol ដែលសំខាន់លើអ៊ីនធឺណិត និងតាមអ៊ីនធឺណិត ហើយកំពុងដាក់ឱ្យដំណើរការនៅទូទាំងកម្រិត ChatGPT រួមទាំង API, Azure និង Bedrock។.
តើមានអ្វីថ្មីនៅក្នុង Meta Muse Spark 1.3 សម្រាប់ភ្នាក់ងារសរសេរកូដ?
Muse Spark 1.3 ផ្តោតលើការសរសេរកូដ និងការប្រើប្រាស់ភ្នាក់ងារតាមរយៈ Muse Code និង Meta Model API។ Meta អះអាងថាការហៅឧបករណ៍តិចជាងប្រហែលម្ភៃភាគរយ និងថូខឹនតិចជាងម្ភៃប្រាំភាគរយបើប្រៀបធៀបទៅនឹង 1.2។ វាសួរសំណួរបញ្ជាក់អំពីការណែនាំមិនច្បាស់លាស់ ផ្អាកមុនសកម្មភាពជាបន្តបន្ទាប់ និងផ្អៀងទៅរកការចាក់បញ្ចូលភ្លាមៗ។ អ្នកទិញសហគ្រាសនៅតែនិយាយថាការតាមដានការដឹកជញ្ជូនបន្ថែមនីមួយៗពីអ្នកលក់ចំនួនបួនក្នុងពេលតែមួយធ្វើឱ្យបាត់បង់ GPU និងការយកចិត្តទុកដាក់តិចតួច។.
ព័ត៌មាន AI ម្សិលមិញ៖ ថ្ងៃទី 5 ខែកញ្ញា ឆ្នាំ 2026
ស្វែងរក AI ចុងក្រោយបំផុតនៅហាងជំនួយការ AI ផ្លូវការ
អំពីយើង