Tag: raising

  • Varo, Stripe said to be raising new funds at much lower valuations

    2022 میں مارکیٹ اس قدر ڈرامائی انداز میں تبدیل ہونے کے ساتھ، یہ کوئی تعجب کی بات نہیں ہے کہ اب بہت سے اسٹارٹ اپس کے بارے میں خیال کیا جاتا ہے کہ وہ راؤنڈ کو بڑھا رہے ہیں۔

    صرف اس ہفتے، یہ اطلاع ملی تھی کہ واربرگ پنکس کی سربراہی میں \”نمایاں طور پر\” کم قیمت پر Varo $50 ملین ایکویٹی راؤنڈ اکٹھا کر رہا ہے۔ کے مطابق فنٹیک بزنس ویکلی، جدوجہد کرنے والا نیوبینک رقم سے پہلے کی قیمت کے حساب سے فنڈ اکٹھا کرے گا۔ $1.8 بلین۔ یہ 2.5 بلین ڈالر سے کم ہے جس کی قیمت ستمبر 2021 میں وارو کی تھی جب اس نے بڑے پیمانے پر اضافہ کیا اور \”زیادہ سبسکرائب کیا\” $510 ملین سیریز E.

    سٹارٹ اپ نے گزشتہ اگست میں کی دو سالہ سالگرہ منائی اپنے قومی بینک کا چارٹر حاصل کرنا – ایک ایسا اقدام جس نے اسے پہلی بار تمام ڈیجیٹل قومی سطح پر چارٹرڈ یو ایس کنزیومر بینک بنا دیا۔. ایک میں انٹرویو TechCrunch کے ساتھ، CEO اور بانی کولن والش نے گزشتہ ستمبر میں اصرار کیا کہ کمپنی \”اب بھی مضبوط کسٹمر نمو دیکھ رہی ہے\” اور اس کے پاس \”منافع کا واضح راستہ ہے۔\”

    TechCrunch اس بارے میں استفسار کرنے کے لیے پہنچ گیا کہ آیا Varo نے درحقیقت $50 ملین کے نئے اضافے کے لیے ایک ٹرم شیٹ پر دستخط کیے ہیں – Warburg Pincus کے ساتھ $25 ملین – لیکن لکھنے کے وقت اس نے واپس نہیں سنا تھا۔

    اس ہفتے بھی، معلومات اطلاع دی کہ ادائیگیوں کی دیو سٹرائپ اب بھی سرمایہ اکٹھا کرنے کی کوشش کر رہی ہے اور اب خیال کیا جاتا ہے کہ کچھ رکاوٹوں کو عبور کرنے کے بعد تقریباً $50 بلین، یا $20 فی شیئر کی قیمت کو ہدف بنا رہی ہے۔ اس سال کے شروع میں، TechCrunch نے اطلاع دی تھی کہ Thrive Capital نے سٹرائیپ کے لیے تازہ سرمائے میں $1 بلین کا وعدہ کیا ہے اس کام میں ایک نئی سرمایہ کاری کے حصے کے طور پر جس سے فنٹیک کمپنی کی قدر $55 بلین اور $60 بلین کے درمیان ہوگی۔

    ابتدائی طور پر، یہ سوچا گیا تھا کہ سٹرائپ 2 بلین ڈالر اکٹھا کرنے کی کوشش کر رہی ہے لیکن اب خیال کیا جاتا ہے کہ یہ تعداد درحقیقت 2.5 بلین سے 3 بلین ڈالر کے قریب ہے، دی کی رپورٹوں کے مطابق۔ نیویارک ٹائمز اور معلومات کے. ایک غیر معمولی موڑ میں، سٹرائپ کے بارے میں خیال کیا جاتا ہے کہ وہ نئے فنڈز اکٹھا کر رہی ہے، جیسا کہ دی انفارمیشن نے رپورٹ کیا، \”اپنے کچھ تجربہ کار ملازمین کے لیے محدود اسٹاک یونٹس کی میعاد ختم ہونے کے مسئلے کو حل کریں — اور ایک بڑے ملازم ٹیکس بل جو ممکنہ طور پر اس کے ساتھ آئے گا۔\”

    حقیقت یہ ہے کہ کمپنی ٹیکس بل کی ادائیگی کے لیے رقم اکٹھی کر سکتی ہے، یہاں TechCrunch میں اندرونی طور پر ابرو اٹھے ہیں۔ یہ عام نہیں ہے، اور یہ یقینی طور پر ایسا نہیں لگتا کہ یہ سرمایہ کاروں کی نقد رقم خرچ کرنے کا ایک مثالی طریقہ ہے۔ کین سمتھ، نیکسٹ راؤنڈ کیپٹل پارٹنرز کے بانی اور سی ای او – ایک کیپیٹل مارکیٹس اور وی سی سیکنڈریز فرم – ہمارے تاثرات کی توثیق کی.

    27 جنوری کو ایک فون انٹرویو میں، اس نے مجھے بتایا کہ \”سرمایہ کاروں کا ایک نئے دور کے بارے میں پرجوش ہونا انتہائی غیر معمولی بات ہے جو بنیادی طور پر بلا معاوضہ ٹیکس ادا کرنے جا رہا ہے۔\”

    کسی بھی طرح سے، حقیقت یہ ہے کہ فنٹیک اسٹارٹ اپس – یا اس معاملے کے لیے کوئی بھی اسٹارٹ اپ – راؤنڈ بڑھا رہے ہیں یہ کوئی بڑی خبر نہیں ہے جو شاید ایک سال پہلے ہوئی ہو۔ جب یا تو بند کرنے یا نیچے راؤنڈ کو بڑھانے کا سامنا کرنا پڑتا ہے، تو زیادہ تر اسٹارٹ اپ بعد والے کا انتخاب کرتے ہیں۔



    >Source link>

    >>Join our Facebook page From top right corner. <<

  • Yoon\’s office mulls raising limit on anti-graft law

    South Korea\’s government office is taking a second look at an anti-graft law, also known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, stated that they are considering the economic measures in a special meeting to make up for the livelihood of the people. Under the law, individuals, including public servants, school teachers, and journalists, are currently subject to fines for spending more than 30,000 won on meals and entertainment. Lee stated that \”we are looking into whether economic measures can be taken in a special meeting related to the livelihood of people.\” As an improper request and graft act was revealed in September 2016, it is also a violation of the law if gifts or rewards exceeding 50,000 won or 100,000 won are exchanged between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had drawn up a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. By Son Ji-hyoung (consnow@heraldcorp.com)

    The South Korean government is currently reviewing an anti-graft law, commonly known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, said that the government is considering economic measures in a special meeting to improve people\’s livelihood. Under the law, individuals, including public servants, school teachers, and journalists, are subject to fines if they spend more than 30,000 won on meals and entertainment. Lee mentioned that they are looking into whether economic measures can be taken in a special meeting related to the livelihood of people. In addition, the law also prohibits exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time.

    The South Korean government is currently reviewing an anti-graft law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. The revised law will help to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. According to statistics in South Korea, user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.

    South Korea is taking a second look at the Kim Young-ran Law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. This revised law is intended to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. Statistics show that user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, thus prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.



    Source link

    Join our Facebook page From top right corner.

  • Yoon\’s office mulls raising limit on anti-graft law

    South Korea\’s government office is taking a second look at an anti-graft law, also known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, stated that they are considering the economic measures in a special meeting to make up for the livelihood of the people. Under the law, individuals, including public servants, school teachers, and journalists, are currently subject to fines for spending more than 30,000 won on meals and entertainment. Lee stated that \”we are looking into whether economic measures can be taken in a special meeting related to the livelihood of people.\” As an improper request and graft act was revealed in September 2016, it is also a violation of the law if gifts or rewards exceeding 50,000 won or 100,000 won are exchanged between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had drawn up a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. By Son Ji-hyoung (consnow@heraldcorp.com)

    The South Korean government is currently reviewing an anti-graft law, commonly known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, said that the government is considering economic measures in a special meeting to improve people\’s livelihood. Under the law, individuals, including public servants, school teachers, and journalists, are subject to fines if they spend more than 30,000 won on meals and entertainment. Lee mentioned that they are looking into whether economic measures can be taken in a special meeting related to the livelihood of people. In addition, the law also prohibits exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time.

    The South Korean government is currently reviewing an anti-graft law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. The revised law will help to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. According to statistics in South Korea, user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.

    South Korea is taking a second look at the Kim Young-ran Law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. This revised law is intended to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. Statistics show that user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, thus prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.



    Source link

    Join our Facebook page From top right corner.

  • Yoon\’s office mulls raising limit on anti-graft law

    South Korea\’s government office is taking a second look at an anti-graft law, also known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, stated that they are considering the economic measures in a special meeting to make up for the livelihood of the people. Under the law, individuals, including public servants, school teachers, and journalists, are currently subject to fines for spending more than 30,000 won on meals and entertainment. Lee stated that \”we are looking into whether economic measures can be taken in a special meeting related to the livelihood of people.\” As an improper request and graft act was revealed in September 2016, it is also a violation of the law if gifts or rewards exceeding 50,000 won or 100,000 won are exchanged between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had drawn up a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. By Son Ji-hyoung (consnow@heraldcorp.com)

    The South Korean government is currently reviewing an anti-graft law, commonly known as the Kim Young-ran Law, to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. Lee Do-Won, the spokesperson of the president\’s office, said that the government is considering economic measures in a special meeting to improve people\’s livelihood. Under the law, individuals, including public servants, school teachers, and journalists, are subject to fines if they spend more than 30,000 won on meals and entertainment. Lee mentioned that they are looking into whether economic measures can be taken in a special meeting related to the livelihood of people. In addition, the law also prohibits exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. These principles are being revised as South Korea has experienced excessive spending in the current situation. According to statistics in South Korea, the indication of user prices has increased by 15 percent from 2016 to 2022 for the necessities of life. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time.

    The South Korean government is currently reviewing an anti-graft law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. The revised law will help to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. According to statistics in South Korea, user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook had proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.

    South Korea is taking a second look at the Kim Young-ran Law to raise the cap on meals and entertainment expenses from 30,000 won ($22.82) to 50,000 won. This revised law is intended to improve people\’s livelihood and prevent exchanging gifts or rewards exceeding 50,000 won or 100,000 won between the parties involved. Statistics show that user prices have increased by 15 percent from 2016 to 2022 for the necessities of life, thus prompting the government to take action. The Democratic Party of Korea\’s representative Kim Byung-wook proposed a second look in January 2022 to reduce the cap. This bill was named after the former judge of the Supreme Court Kim Keum, who was the head of the Anti-Corruption and Civil Rights Commission at that time. The government is currently considering economic measures in a special meeting to make up for the livelihood of the people.



    Source link

    Join our Facebook page From top right corner.

  • ANALYSIS | Bank of Canada might need to raise rates if companies keep raising prices, Macklem warns | CBC News

    [

    It may sound like a circular argument, but the only way to stop inflation is to stop companies from raising prices. And the only way to stop that is to get inflation under control. And that could mean an end to the interest rate hike pause.

    After Tuesday\’s latest release of inflation data, warnings from Bank of Canada governor Tiff Macklem in his testimony to parliament last week offer a stark reminder of how difficult, but how essential, it is to convince the sellers of goods and services to stop raising prices.

    While overall inflation has eased to 5.9 per cent, that\’s still high. Groceries are up another 11.4 per cent. 

    That\’s difficult for consumers, whether businesses buying from other businesses or ordinary Canadian shoppers. Macklem said they simply cannot distinguish reasonable and necessary price rises to cover rising costs from price hikes merely to pad the bottom line.

    He warns sellers: if price hikes continue at the pace we\’ve seen recently, he may be forced to take action. 

    Hidden in plain sight

    The latest slowdown in rising prices, finally falling below six per cent for the first time since February a year ago, is being read by many as a favourable sign.

    Though it\’s useful to view that number in context: that\’s 5.9 per cent higher than a year ago when prices were already rising quickly, or what economists call the \”base-year effect.\” 

    A fall in global oil prices, which last week Macklem described as the \”biggest contributor\” to falling inflation, obscure the rising cost of other consumer necessities, like food.

    As people as diverse as Federal Reserve chair Jerome Powell and Canadian labour economist Jim Stanford have noted, despite continued talk of a wage-price spiral, wages have not led the post-COVID bout of inflation. Wage hikes have steadily been below inflation. Latest Canadian jobs figures show wage hikes are declining, currently running at 4.5 per cent, more than a full percentage point below rising prices.

    \”It looks more like profit-price inflation to me where companies very opportunistically have taken advantage of a disruptive moment to soak consumers for more than they need to,\” was Stanford\’s analysis in an interview with the CBC last year.

    And in last Thursday\’s testimony to the Parliamentary Finance Committee, Macklem seemed to agree.

    \"Can
    The failure of businesses to \’normalize\’ pricing, testified Bank of Canada governor Tiff Macklem, is one of the things that could force the central bank to end its pause and keep raising interest rates. (Blair Gable/Reuters)

    Macklem explained that a period of generally rising prices is a special opportunity for sellers. In the confusion of widespread price increases, consumers simply cannot distinguish between reasonable price increases due to a discreet cause — a frost in Florida that raises orange prices, for example — and price hikes meant to squeeze the customer and increase profits.

    \”When an economy is overheated, when inflation is high, when people see prices of everything going up, it makes it easier for companies to raise their prices because people can\’t tell, is this … a generalized increase or is this just this company raising their prices?\” testified Macklem last week.

    In economics, the general principle is that sellers want to raise their prices as much as possible to maximize their profits. One of the reasons businesses have trouble doing that in normal, non-inflationary times is that consumers keep an eagle eye on price hikes and shun sellers they think are being greedy. But during periods of high inflation, unjustified individual price hikes are harder to distinguish and therefore retailers are harder to punish.

    WATCH | What\’s causing inflation to slow: 

    \"\"

    Chicken prices soar as inflation cools

    Inflation in Canada is down to 5.9 per cent, but food prices are still high with chicken becoming a big-ticket item on the grocery bill.

    \”When the economy is better balanced between supply and demand, the competitive function works much better and it\’s a lot more difficult for companies to raise prices because they\’ll lose market share,\” said Macklem. 

    \”They\’ll lose their customers.\”

    Bigger, more frequent price hikes

    This round of inflation had real causes: when supply chains suddenly gummed up and oil prices soared, many sellers were forced to raise their prices. Higher fuel costs and a shortage of cargo vessels meant goods cost more to ship. High worldwide demand for goods in short supply pushed input prices higher. 

    Essentially everyone who could was just doing their best to pass on their higher costs causing an unfamiliar flurry of pricing activity that h
    ad not been seen in decades, Bank of Canada research showed.

    \”The distribution of price-setting behaviour of companies changed,\” Macklem told the parliamentary committee members. \”Pricing increases were bigger, they were more frequent.\”

    But as supply chains opened up those price hikes should have begun to cool down.

    The debate over whether grocery retailers in particular have raised prices too much continues to rage and may be revisited later this week when food retailer Loblaws unveils its corporate results on Thursday. The company, like other grocery chains, insists its price rises reflect increased costs.

    Critics have pointed to soaring profits. 

    The correlation between Loblaw\’s share price and the take-off of inflation in Canada is uncanny. While grocery CEOs complain they are just victims of inflation like the rest of us, merely \”passing on\” higher costs, their investors know otherwise. /2 <a href=\”https://t.co/U1GParvi0u\”>pic.twitter.com/U1GParvi0u</a>

    &mdash;@JimboStanford

    It may be that shareholders will rejoice if they see profits continue to rise at the expense of consumer prices but if the pace and size of price hikes don\’t go back the way they used to be, to \”normalize\” in Bank of Canada language, Macklem says he has a surprise up his sleeve.

    There are many sceptics who say inflation has no intention of going peacefully and that it will be \”sticky.\” The last time rising prices got seriously out of hand, \”The Great Inflation,\” only ended in the 1980s after a brutal interest-rate shock that saw mortgage rates approach 20 per cent. That ended inflation with a bang and a devastating recession.

    So far central bankers seem confident that won\’t happen this time. But if businesses don\’t get pricing under control soon, Macklem said he will have to do something about it.

    \”That process of normalization is one of the key things we\’re watching to evaluate whether we raised interest rates enough to get inflation back down to target,\” testified Macklem.

    \”And if we don\’t see it continue to normalize, we will need to do more.\”





    Source link

    Join our Facebook page
    https://www.facebook.com/groups/www.pakistanaffairs.pk

  • Beyond memorization: Text generators may plagiarize beyond \’copy and paste\’: Language models, possibly including ChatGPT, paraphrase and reuse ideas from training data without citing the source, raising plagiarism concerns

    طلباء اپنی اگلی اسائنمنٹ مکمل کرنے کے لیے چیٹ بوٹ استعمال کرنے سے پہلے دو بار سوچ سکتے ہیں۔ زبان کے ماڈل جو صارف کے اشارے کے جواب میں متن تیار کرتے ہیں وہ مواد کو ایک سے زیادہ طریقوں سے سرقہ کرتے ہیں، پین اسٹیٹ کی زیرقیادت ایک تحقیقی ٹیم کے مطابق جس نے اس رجحان کا براہ راست جائزہ لینے کے لیے پہلا مطالعہ کیا۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے پروفیسر ڈونگون لی نے کہا، \”سرقہ سرقہ مختلف ذائقوں میں آتا ہے۔\” \”ہم یہ دیکھنا چاہتے تھے کہ کیا زبان کے ماڈل نہ صرف کاپی اور پیسٹ کرتے ہیں بلکہ اس کو سمجھے بغیر سرقہ کی مزید نفیس شکلوں کا سہارا لیتے ہیں۔\”

    محققین نے سرقہ کی تین شکلوں کی شناخت پر توجہ مرکوز کی: لفظی طور پر، یا براہ راست مواد کو کاپی اور پیسٹ کرنا؛ اصل ماخذ کا حوالہ دیے بغیر پیرا فریز، یا مواد کو دوبارہ ترتیب دینا اور دوبارہ ترتیب دینا؛ اور آئیڈیا، یا کسی متن سے بغیر کسی مناسب انتساب کے مرکزی خیال کا استعمال کرنا۔ انہوں نے خودکار سرقہ کا پتہ لگانے کے لیے ایک پائپ لائن بنائی اور اسے OpenAI کے GPT-2 کے خلاف آزمایا کیونکہ زبان کے ماڈل کا تربیتی ڈیٹا آن لائن دستیاب ہے، جس سے محققین GPT-2 کو پہلے سے تربیت دینے کے لیے استعمال ہونے والی 8 ملین دستاویزات سے تخلیق شدہ متن کا موازنہ کرنے کی اجازت دیتے ہیں۔

    سائنس دانوں نے 210,000 تخلیق شدہ تحریروں کو پہلے سے تربیت یافتہ لینگویج ماڈلز اور فائن ٹیونڈ لینگویج ماڈلز میں سرقہ کی جانچ کرنے کے لیے استعمال کیا، یا مخصوص موضوعات پر توجہ مرکوز کرنے کے لیے مزید تربیت یافتہ ماڈلز۔ اس معاملے میں، ٹیم نے سائنسی دستاویزات، COVID-19 سے متعلق علمی مضامین، اور پیٹنٹ کے دعووں پر توجہ مرکوز کرنے کے لیے تین زبانوں کے ماڈلز کو ٹھیک بنایا۔ انہوں نے ایک اوپن سورس سرچ انجن کا استعمال کرتے ہوئے سرفہرست 10 تربیتی دستاویزات کو بازیافت کیا جو ہر تیار کردہ متن سے ملتا جلتا ہے اور لفظی، پیرا فریز اور آئیڈیا سرقہ کی مثالوں کا بہتر طور پر پتہ لگانے کے لیے موجودہ ٹیکسٹ الائنمنٹ الگورتھم میں ترمیم کی۔

    ٹیم نے پایا کہ زبان کے ماڈلز نے تینوں قسم کے سرقہ کا ارتکاب کیا، اور یہ کہ ماڈل کو تربیت دینے کے لیے ڈیٹاسیٹ اور پیرامیٹرز جتنے بڑے ہوں گے، اتنا ہی اکثر سرقہ ہوتا ہے۔ انہوں نے یہ بھی نوٹ کیا کہ زبان کے عمدہ ماڈلز نے لفظی سرقہ کو کم کیا لیکن پیرا فریز اور آئیڈیا سرقہ کی مثالوں میں اضافہ کیا۔ اس کے علاوہ، انہوں نے زبان کے ماڈل کی ایسی مثالوں کی نشاندہی کی جو سرقہ کی تینوں شکلوں کے ذریعے افراد کی نجی معلومات کو بے نقاب کرتے ہیں۔ محققین اپنے نتائج 2023 ACM ویب کانفرنس میں پیش کریں گے، جو آسٹن، ٹیکساس میں 30 اپریل سے 4 مئی تک ہوتی ہے۔

    پین اسٹیٹ کے کالج آف انفارمیشن سائنسز اینڈ ٹیکنالوجی میں ڈاکٹریٹ کے طالب علم لیڈ مصنف جویونگ لی نے کہا، \”لوگ بڑے زبان کے ماڈلز کی پیروی کرتے ہیں کیونکہ ماڈل جتنا بڑا ہوتا ہے، نسل کی صلاحیتوں میں اضافہ ہوتا ہے۔\” \”ایک ہی وقت میں، وہ تربیتی کارپس کے اندر موجود مواد کی اصلیت اور تخلیقی صلاحیتوں کو خطرے میں ڈال رہے ہیں۔ یہ ایک اہم تلاش ہے۔\”

    محققین کے مطابق، مطالعہ ٹیکسٹ جنریٹرز اور اخلاقی اور فلسفیانہ سوالات کے بارے میں مزید تحقیق کی ضرورت پر روشنی ڈالتا ہے۔

    مسیسیپی یونیورسٹی میں کمپیوٹر اور انفارمیشن سائنس کے اسسٹنٹ پروفیسر تھائی لی نے کہا، \”اگرچہ آؤٹ پٹ پرکشش ہو سکتا ہے، اور زبان کے ماڈلز استعمال کرنے میں مزہ آ سکتے ہیں اور کچھ کاموں کے لیے نتیجہ خیز لگ سکتے ہیں، لیکن اس کا مطلب یہ نہیں ہے کہ وہ عملی ہیں۔\” جنہوں نے پین اسٹیٹ میں ڈاکٹریٹ کے امیدوار کے طور پر اس پروجیکٹ پر کام کرنا شروع کیا۔ \”عملی طور پر، ہمیں ان اخلاقی اور کاپی رائٹ کے مسائل کا خیال رکھنے کی ضرورت ہے جو ٹیکسٹ جنریٹر لاحق ہوتے ہیں۔\”

    اگرچہ مطالعہ کے نتائج صرف GPT-2 پر لاگو ہوتے ہیں، خودکار سرقہ کا پتہ لگانے کا عمل جو محققین نے قائم کیا ہے اسے نئے زبان کے ماڈلز جیسے ChatGPT پر لاگو کیا جا سکتا ہے تاکہ اس بات کا تعین کیا جا سکے کہ آیا یہ ماڈل تربیتی مواد کی سرقہ کرتے ہیں یا نہیں۔ محققین نے کہا کہ سرقہ کی جانچ، تاہم، ڈویلپرز پر منحصر ہے کہ وہ تربیتی ڈیٹا کو عوامی طور پر قابل رسائی بناتے ہیں۔

    سائنسدانوں کے مطابق، موجودہ مطالعہ AI محققین کو مستقبل میں مزید مضبوط، قابل اعتماد اور ذمہ دار زبان کے ماڈل بنانے میں مدد دے سکتا ہے۔ فی الحال، وہ لوگوں سے ٹیکسٹ جنریٹر استعمال کرتے وقت احتیاط برتنے کی تاکید کرتے ہیں۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے اسسٹنٹ پروفیسر، Jinghui چن نے کہا، \”AI محققین اور سائنس دان اس بات کا مطالعہ کر رہے ہیں کہ زبان کے ماڈلز کو کس طرح بہتر اور زیادہ مضبوط بنایا جائے، اس دوران، بہت سے افراد اپنی روزمرہ کی زندگی میں زبان کے ماڈلز کو مختلف پیداواری کاموں کے لیے استعمال کر رہے ہیں۔\” \”جبکہ لینگویج ماڈلز کو سرچ انجن کے طور پر استعمال کرنا یا ڈیبگ کوڈ کے لیے اسٹیک اوور فلو کرنا شاید ٹھیک ہے، دوسرے مقاصد کے لیے، چونکہ لینگویج ماڈل سرقہ شدہ مواد تیار کر سکتا ہے، اس کے نتیجے میں صارف کے لیے منفی نتائج نکل سکتے ہیں۔\”

    ڈونگ وون لی نے مزید کہا کہ سرقہ کا نتیجہ کچھ غیر متوقع نہیں ہے۔

    انہوں نے کہا کہ \”ایک سٹاکسٹک طوطے کے طور پر، ہم نے زبان کے ماڈلز کو انسانی تحریروں کی نقل کرنا سکھایا بغیر انہیں یہ سکھایا کہ کیسے صحیح طریقے سے سرقہ نہ کیا جائے۔\” \”اب وقت آگیا ہے کہ انہیں مزید صحیح طریقے سے لکھنا سکھایا جائے، اور ہمیں ابھی بہت طویل سفر طے کرنا ہے۔\”

    نیشنل سائنس فاؤنڈیشن نے اس کام کی حمایت کی۔



    Source link

  • Beyond memorization: Text generators may plagiarize beyond \’copy and paste\’: Language models, possibly including ChatGPT, paraphrase and reuse ideas from training data without citing the source, raising plagiarism concerns

    طلباء اپنی اگلی اسائنمنٹ مکمل کرنے کے لیے چیٹ بوٹ استعمال کرنے سے پہلے دو بار سوچ سکتے ہیں۔ زبان کے ماڈل جو صارف کے اشارے کے جواب میں متن تیار کرتے ہیں وہ مواد کو ایک سے زیادہ طریقوں سے سرقہ کرتے ہیں، پین اسٹیٹ کی زیرقیادت ایک تحقیقی ٹیم کے مطابق جس نے اس رجحان کا براہ راست جائزہ لینے کے لیے پہلا مطالعہ کیا۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے پروفیسر ڈونگون لی نے کہا، \”سرقہ سرقہ مختلف ذائقوں میں آتا ہے۔\” \”ہم یہ دیکھنا چاہتے تھے کہ کیا زبان کے ماڈل نہ صرف کاپی اور پیسٹ کرتے ہیں بلکہ اس کو سمجھے بغیر سرقہ کی مزید نفیس شکلوں کا سہارا لیتے ہیں۔\”

    محققین نے سرقہ کی تین شکلوں کی شناخت پر توجہ مرکوز کی: لفظی طور پر، یا براہ راست مواد کو کاپی اور پیسٹ کرنا؛ اصل ماخذ کا حوالہ دیے بغیر پیرا فریز، یا مواد کو دوبارہ ترتیب دینا اور دوبارہ ترتیب دینا؛ اور آئیڈیا، یا کسی متن سے بغیر کسی مناسب انتساب کے مرکزی خیال کا استعمال کرنا۔ انہوں نے خودکار سرقہ کا پتہ لگانے کے لیے ایک پائپ لائن بنائی اور اسے OpenAI کے GPT-2 کے خلاف آزمایا کیونکہ زبان کے ماڈل کا تربیتی ڈیٹا آن لائن دستیاب ہے، جس سے محققین GPT-2 کو پہلے سے تربیت دینے کے لیے استعمال ہونے والی 8 ملین دستاویزات سے تخلیق شدہ متن کا موازنہ کرنے کی اجازت دیتے ہیں۔

    سائنس دانوں نے 210,000 تخلیق شدہ تحریروں کو پہلے سے تربیت یافتہ لینگویج ماڈلز اور فائن ٹیونڈ لینگویج ماڈلز میں سرقہ کی جانچ کرنے کے لیے استعمال کیا، یا مخصوص موضوعات پر توجہ مرکوز کرنے کے لیے مزید تربیت یافتہ ماڈلز۔ اس معاملے میں، ٹیم نے سائنسی دستاویزات، COVID-19 سے متعلق علمی مضامین، اور پیٹنٹ کے دعووں پر توجہ مرکوز کرنے کے لیے تین زبانوں کے ماڈلز کو ٹھیک بنایا۔ انہوں نے ایک اوپن سورس سرچ انجن کا استعمال کرتے ہوئے سرفہرست 10 تربیتی دستاویزات کو بازیافت کیا جو ہر تیار کردہ متن سے ملتا جلتا ہے اور لفظی، پیرا فریز اور آئیڈیا سرقہ کی مثالوں کا بہتر طور پر پتہ لگانے کے لیے موجودہ ٹیکسٹ الائنمنٹ الگورتھم میں ترمیم کی۔

    ٹیم نے پایا کہ زبان کے ماڈلز نے تینوں قسم کے سرقہ کا ارتکاب کیا، اور یہ کہ ماڈل کو تربیت دینے کے لیے ڈیٹاسیٹ اور پیرامیٹرز جتنے بڑے ہوں گے، اتنا ہی اکثر سرقہ ہوتا ہے۔ انہوں نے یہ بھی نوٹ کیا کہ زبان کے عمدہ ماڈلز نے لفظی سرقہ کو کم کیا لیکن پیرا فریز اور آئیڈیا سرقہ کی مثالوں میں اضافہ کیا۔ اس کے علاوہ، انہوں نے زبان کے ماڈل کی ایسی مثالوں کی نشاندہی کی جو سرقہ کی تینوں شکلوں کے ذریعے افراد کی نجی معلومات کو بے نقاب کرتے ہیں۔ محققین اپنے نتائج 2023 ACM ویب کانفرنس میں پیش کریں گے، جو آسٹن، ٹیکساس میں 30 اپریل سے 4 مئی تک ہوتی ہے۔

    پین اسٹیٹ کے کالج آف انفارمیشن سائنسز اینڈ ٹیکنالوجی میں ڈاکٹریٹ کے طالب علم لیڈ مصنف جویونگ لی نے کہا، \”لوگ بڑے زبان کے ماڈلز کی پیروی کرتے ہیں کیونکہ ماڈل جتنا بڑا ہوتا ہے، نسل کی صلاحیتوں میں اضافہ ہوتا ہے۔\” \”ایک ہی وقت میں، وہ تربیتی کارپس کے اندر موجود مواد کی اصلیت اور تخلیقی صلاحیتوں کو خطرے میں ڈال رہے ہیں۔ یہ ایک اہم تلاش ہے۔\”

    محققین کے مطابق، مطالعہ ٹیکسٹ جنریٹرز اور اخلاقی اور فلسفیانہ سوالات کے بارے میں مزید تحقیق کی ضرورت پر روشنی ڈالتا ہے۔

    مسیسیپی یونیورسٹی میں کمپیوٹر اور انفارمیشن سائنس کے اسسٹنٹ پروفیسر تھائی لی نے کہا، \”اگرچہ آؤٹ پٹ پرکشش ہو سکتا ہے، اور زبان کے ماڈلز استعمال کرنے میں مزہ آ سکتے ہیں اور کچھ کاموں کے لیے نتیجہ خیز لگ سکتے ہیں، لیکن اس کا مطلب یہ نہیں ہے کہ وہ عملی ہیں۔\” جنہوں نے پین اسٹیٹ میں ڈاکٹریٹ کے امیدوار کے طور پر اس پروجیکٹ پر کام کرنا شروع کیا۔ \”عملی طور پر، ہمیں ان اخلاقی اور کاپی رائٹ کے مسائل کا خیال رکھنے کی ضرورت ہے جو ٹیکسٹ جنریٹر لاحق ہوتے ہیں۔\”

    اگرچہ مطالعہ کے نتائج صرف GPT-2 پر لاگو ہوتے ہیں، خودکار سرقہ کا پتہ لگانے کا عمل جو محققین نے قائم کیا ہے اسے نئے زبان کے ماڈلز جیسے ChatGPT پر لاگو کیا جا سکتا ہے تاکہ اس بات کا تعین کیا جا سکے کہ آیا یہ ماڈل تربیتی مواد کی سرقہ کرتے ہیں یا نہیں۔ محققین نے کہا کہ سرقہ کی جانچ، تاہم، ڈویلپرز پر منحصر ہے کہ وہ تربیتی ڈیٹا کو عوامی طور پر قابل رسائی بناتے ہیں۔

    سائنسدانوں کے مطابق، موجودہ مطالعہ AI محققین کو مستقبل میں مزید مضبوط، قابل اعتماد اور ذمہ دار زبان کے ماڈل بنانے میں مدد دے سکتا ہے۔ فی الحال، وہ لوگوں سے ٹیکسٹ جنریٹر استعمال کرتے وقت احتیاط برتنے کی تاکید کرتے ہیں۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے اسسٹنٹ پروفیسر، Jinghui چن نے کہا، \”AI محققین اور سائنس دان اس بات کا مطالعہ کر رہے ہیں کہ زبان کے ماڈلز کو کس طرح بہتر اور زیادہ مضبوط بنایا جائے، اس دوران، بہت سے افراد اپنی روزمرہ کی زندگی میں زبان کے ماڈلز کو مختلف پیداواری کاموں کے لیے استعمال کر رہے ہیں۔\” \”جبکہ لینگویج ماڈلز کو سرچ انجن کے طور پر استعمال کرنا یا ڈیبگ کوڈ کے لیے اسٹیک اوور فلو کرنا شاید ٹھیک ہے، دوسرے مقاصد کے لیے، چونکہ لینگویج ماڈل سرقہ شدہ مواد تیار کر سکتا ہے، اس کے نتیجے میں صارف کے لیے منفی نتائج نکل سکتے ہیں۔\”

    ڈونگ وون لی نے مزید کہا کہ سرقہ کا نتیجہ کچھ غیر متوقع نہیں ہے۔

    انہوں نے کہا کہ \”ایک سٹاکسٹک طوطے کے طور پر، ہم نے زبان کے ماڈلز کو انسانی تحریروں کی نقل کرنا سکھایا بغیر انہیں یہ سکھایا کہ کیسے صحیح طریقے سے سرقہ نہ کیا جائے۔\” \”اب وقت آگیا ہے کہ انہیں مزید صحیح طریقے سے لکھنا سکھایا جائے، اور ہمیں ابھی بہت طویل سفر طے کرنا ہے۔\”

    نیشنل سائنس فاؤنڈیشن نے اس کام کی حمایت کی۔



    Source link

  • Beyond memorization: Text generators may plagiarize beyond \’copy and paste\’: Language models, possibly including ChatGPT, paraphrase and reuse ideas from training data without citing the source, raising plagiarism concerns

    طلباء اپنی اگلی اسائنمنٹ مکمل کرنے کے لیے چیٹ بوٹ استعمال کرنے سے پہلے دو بار سوچ سکتے ہیں۔ زبان کے ماڈل جو صارف کے اشارے کے جواب میں متن تیار کرتے ہیں وہ مواد کو ایک سے زیادہ طریقوں سے سرقہ کرتے ہیں، پین اسٹیٹ کی زیرقیادت ایک تحقیقی ٹیم کے مطابق جس نے اس رجحان کا براہ راست جائزہ لینے کے لیے پہلا مطالعہ کیا۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے پروفیسر ڈونگون لی نے کہا، \”سرقہ سرقہ مختلف ذائقوں میں آتا ہے۔\” \”ہم یہ دیکھنا چاہتے تھے کہ کیا زبان کے ماڈل نہ صرف کاپی اور پیسٹ کرتے ہیں بلکہ اس کو سمجھے بغیر سرقہ کی مزید نفیس شکلوں کا سہارا لیتے ہیں۔\”

    محققین نے سرقہ کی تین شکلوں کی شناخت پر توجہ مرکوز کی: لفظی طور پر، یا براہ راست مواد کو کاپی اور پیسٹ کرنا؛ اصل ماخذ کا حوالہ دیے بغیر پیرا فریز، یا مواد کو دوبارہ ترتیب دینا اور دوبارہ ترتیب دینا؛ اور آئیڈیا، یا کسی متن سے بغیر کسی مناسب انتساب کے مرکزی خیال کا استعمال کرنا۔ انہوں نے خودکار سرقہ کا پتہ لگانے کے لیے ایک پائپ لائن بنائی اور اسے OpenAI کے GPT-2 کے خلاف آزمایا کیونکہ زبان کے ماڈل کا تربیتی ڈیٹا آن لائن دستیاب ہے، جس سے محققین GPT-2 کو پہلے سے تربیت دینے کے لیے استعمال ہونے والی 8 ملین دستاویزات سے تخلیق شدہ متن کا موازنہ کرنے کی اجازت دیتے ہیں۔

    سائنس دانوں نے 210,000 تخلیق شدہ تحریروں کو پہلے سے تربیت یافتہ لینگویج ماڈلز اور فائن ٹیونڈ لینگویج ماڈلز میں سرقہ کی جانچ کرنے کے لیے استعمال کیا، یا مخصوص موضوعات پر توجہ مرکوز کرنے کے لیے مزید تربیت یافتہ ماڈلز۔ اس معاملے میں، ٹیم نے سائنسی دستاویزات، COVID-19 سے متعلق علمی مضامین، اور پیٹنٹ کے دعووں پر توجہ مرکوز کرنے کے لیے تین زبانوں کے ماڈلز کو ٹھیک بنایا۔ انہوں نے ایک اوپن سورس سرچ انجن کا استعمال کرتے ہوئے سرفہرست 10 تربیتی دستاویزات کو بازیافت کیا جو ہر تیار کردہ متن سے ملتا جلتا ہے اور لفظی، پیرا فریز اور آئیڈیا سرقہ کی مثالوں کا بہتر طور پر پتہ لگانے کے لیے موجودہ ٹیکسٹ الائنمنٹ الگورتھم میں ترمیم کی۔

    ٹیم نے پایا کہ زبان کے ماڈلز نے تینوں قسم کے سرقہ کا ارتکاب کیا، اور یہ کہ ماڈل کو تربیت دینے کے لیے ڈیٹاسیٹ اور پیرامیٹرز جتنے بڑے ہوں گے، اتنا ہی اکثر سرقہ ہوتا ہے۔ انہوں نے یہ بھی نوٹ کیا کہ زبان کے عمدہ ماڈلز نے لفظی سرقہ کو کم کیا لیکن پیرا فریز اور آئیڈیا سرقہ کی مثالوں میں اضافہ کیا۔ اس کے علاوہ، انہوں نے زبان کے ماڈل کی ایسی مثالوں کی نشاندہی کی جو سرقہ کی تینوں شکلوں کے ذریعے افراد کی نجی معلومات کو بے نقاب کرتے ہیں۔ محققین اپنے نتائج 2023 ACM ویب کانفرنس میں پیش کریں گے، جو آسٹن، ٹیکساس میں 30 اپریل سے 4 مئی تک ہوتی ہے۔

    پین اسٹیٹ کے کالج آف انفارمیشن سائنسز اینڈ ٹیکنالوجی میں ڈاکٹریٹ کے طالب علم لیڈ مصنف جویونگ لی نے کہا، \”لوگ بڑے زبان کے ماڈلز کی پیروی کرتے ہیں کیونکہ ماڈل جتنا بڑا ہوتا ہے، نسل کی صلاحیتوں میں اضافہ ہوتا ہے۔\” \”ایک ہی وقت میں، وہ تربیتی کارپس کے اندر موجود مواد کی اصلیت اور تخلیقی صلاحیتوں کو خطرے میں ڈال رہے ہیں۔ یہ ایک اہم تلاش ہے۔\”

    محققین کے مطابق، مطالعہ ٹیکسٹ جنریٹرز اور اخلاقی اور فلسفیانہ سوالات کے بارے میں مزید تحقیق کی ضرورت پر روشنی ڈالتا ہے۔

    مسیسیپی یونیورسٹی میں کمپیوٹر اور انفارمیشن سائنس کے اسسٹنٹ پروفیسر تھائی لی نے کہا، \”اگرچہ آؤٹ پٹ پرکشش ہو سکتا ہے، اور زبان کے ماڈلز استعمال کرنے میں مزہ آ سکتے ہیں اور کچھ کاموں کے لیے نتیجہ خیز لگ سکتے ہیں، لیکن اس کا مطلب یہ نہیں ہے کہ وہ عملی ہیں۔\” جنہوں نے پین اسٹیٹ میں ڈاکٹریٹ کے امیدوار کے طور پر اس پروجیکٹ پر کام کرنا شروع کیا۔ \”عملی طور پر، ہمیں ان اخلاقی اور کاپی رائٹ کے مسائل کا خیال رکھنے کی ضرورت ہے جو ٹیکسٹ جنریٹر لاحق ہوتے ہیں۔\”

    اگرچہ مطالعہ کے نتائج صرف GPT-2 پر لاگو ہوتے ہیں، خودکار سرقہ کا پتہ لگانے کا عمل جو محققین نے قائم کیا ہے اسے نئے زبان کے ماڈلز جیسے ChatGPT پر لاگو کیا جا سکتا ہے تاکہ اس بات کا تعین کیا جا سکے کہ آیا یہ ماڈل تربیتی مواد کی سرقہ کرتے ہیں یا نہیں۔ محققین نے کہا کہ سرقہ کی جانچ، تاہم، ڈویلپرز پر منحصر ہے کہ وہ تربیتی ڈیٹا کو عوامی طور پر قابل رسائی بناتے ہیں۔

    سائنسدانوں کے مطابق، موجودہ مطالعہ AI محققین کو مستقبل میں مزید مضبوط، قابل اعتماد اور ذمہ دار زبان کے ماڈل بنانے میں مدد دے سکتا ہے۔ فی الحال، وہ لوگوں سے ٹیکسٹ جنریٹر استعمال کرتے وقت احتیاط برتنے کی تاکید کرتے ہیں۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے اسسٹنٹ پروفیسر، Jinghui چن نے کہا، \”AI محققین اور سائنس دان اس بات کا مطالعہ کر رہے ہیں کہ زبان کے ماڈلز کو کس طرح بہتر اور زیادہ مضبوط بنایا جائے، اس دوران، بہت سے افراد اپنی روزمرہ کی زندگی میں زبان کے ماڈلز کو مختلف پیداواری کاموں کے لیے استعمال کر رہے ہیں۔\” \”جبکہ لینگویج ماڈلز کو سرچ انجن کے طور پر استعمال کرنا یا ڈیبگ کوڈ کے لیے اسٹیک اوور فلو کرنا شاید ٹھیک ہے، دوسرے مقاصد کے لیے، چونکہ لینگویج ماڈل سرقہ شدہ مواد تیار کر سکتا ہے، اس کے نتیجے میں صارف کے لیے منفی نتائج نکل سکتے ہیں۔\”

    ڈونگ وون لی نے مزید کہا کہ سرقہ کا نتیجہ کچھ غیر متوقع نہیں ہے۔

    انہوں نے کہا کہ \”ایک سٹاکسٹک طوطے کے طور پر، ہم نے زبان کے ماڈلز کو انسانی تحریروں کی نقل کرنا سکھایا بغیر انہیں یہ سکھایا کہ کیسے صحیح طریقے سے سرقہ نہ کیا جائے۔\” \”اب وقت آگیا ہے کہ انہیں مزید صحیح طریقے سے لکھنا سکھایا جائے، اور ہمیں ابھی بہت طویل سفر طے کرنا ہے۔\”

    نیشنل سائنس فاؤنڈیشن نے اس کام کی حمایت کی۔



    Source link

  • Beyond memorization: Text generators may plagiarize beyond \’copy and paste\’: Language models, possibly including ChatGPT, paraphrase and reuse ideas from training data without citing the source, raising plagiarism concerns

    طلباء اپنی اگلی اسائنمنٹ مکمل کرنے کے لیے چیٹ بوٹ استعمال کرنے سے پہلے دو بار سوچ سکتے ہیں۔ زبان کے ماڈل جو صارف کے اشارے کے جواب میں متن تیار کرتے ہیں وہ مواد کو ایک سے زیادہ طریقوں سے سرقہ کرتے ہیں، پین اسٹیٹ کی زیرقیادت ایک تحقیقی ٹیم کے مطابق جس نے اس رجحان کا براہ راست جائزہ لینے کے لیے پہلا مطالعہ کیا۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے پروفیسر ڈونگون لی نے کہا، \”سرقہ سرقہ مختلف ذائقوں میں آتا ہے۔\” \”ہم یہ دیکھنا چاہتے تھے کہ کیا زبان کے ماڈل نہ صرف کاپی اور پیسٹ کرتے ہیں بلکہ اس کو سمجھے بغیر سرقہ کی مزید نفیس شکلوں کا سہارا لیتے ہیں۔\”

    محققین نے سرقہ کی تین شکلوں کی شناخت پر توجہ مرکوز کی: لفظی طور پر، یا براہ راست مواد کو کاپی اور پیسٹ کرنا؛ اصل ماخذ کا حوالہ دیے بغیر پیرا فریز، یا مواد کو دوبارہ ترتیب دینا اور دوبارہ ترتیب دینا؛ اور آئیڈیا، یا کسی متن سے بغیر کسی مناسب انتساب کے مرکزی خیال کا استعمال کرنا۔ انہوں نے خودکار سرقہ کا پتہ لگانے کے لیے ایک پائپ لائن بنائی اور اسے OpenAI کے GPT-2 کے خلاف آزمایا کیونکہ زبان کے ماڈل کا تربیتی ڈیٹا آن لائن دستیاب ہے، جس سے محققین GPT-2 کو پہلے سے تربیت دینے کے لیے استعمال ہونے والی 8 ملین دستاویزات سے تخلیق شدہ متن کا موازنہ کرنے کی اجازت دیتے ہیں۔

    سائنس دانوں نے 210,000 تخلیق شدہ تحریروں کو پہلے سے تربیت یافتہ لینگویج ماڈلز اور فائن ٹیونڈ لینگویج ماڈلز میں سرقہ کی جانچ کرنے کے لیے استعمال کیا، یا مخصوص موضوعات پر توجہ مرکوز کرنے کے لیے مزید تربیت یافتہ ماڈلز۔ اس معاملے میں، ٹیم نے سائنسی دستاویزات، COVID-19 سے متعلق علمی مضامین، اور پیٹنٹ کے دعووں پر توجہ مرکوز کرنے کے لیے تین زبانوں کے ماڈلز کو ٹھیک بنایا۔ انہوں نے ایک اوپن سورس سرچ انجن کا استعمال کرتے ہوئے سرفہرست 10 تربیتی دستاویزات کو بازیافت کیا جو ہر تیار کردہ متن سے ملتا جلتا ہے اور لفظی، پیرا فریز اور آئیڈیا سرقہ کی مثالوں کا بہتر طور پر پتہ لگانے کے لیے موجودہ ٹیکسٹ الائنمنٹ الگورتھم میں ترمیم کی۔

    ٹیم نے پایا کہ زبان کے ماڈلز نے تینوں قسم کے سرقہ کا ارتکاب کیا، اور یہ کہ ماڈل کو تربیت دینے کے لیے ڈیٹاسیٹ اور پیرامیٹرز جتنے بڑے ہوں گے، اتنا ہی اکثر سرقہ ہوتا ہے۔ انہوں نے یہ بھی نوٹ کیا کہ زبان کے عمدہ ماڈلز نے لفظی سرقہ کو کم کیا لیکن پیرا فریز اور آئیڈیا سرقہ کی مثالوں میں اضافہ کیا۔ اس کے علاوہ، انہوں نے زبان کے ماڈل کی ایسی مثالوں کی نشاندہی کی جو سرقہ کی تینوں شکلوں کے ذریعے افراد کی نجی معلومات کو بے نقاب کرتے ہیں۔ محققین اپنے نتائج 2023 ACM ویب کانفرنس میں پیش کریں گے، جو آسٹن، ٹیکساس میں 30 اپریل سے 4 مئی تک ہوتی ہے۔

    پین اسٹیٹ کے کالج آف انفارمیشن سائنسز اینڈ ٹیکنالوجی میں ڈاکٹریٹ کے طالب علم لیڈ مصنف جویونگ لی نے کہا، \”لوگ بڑے زبان کے ماڈلز کی پیروی کرتے ہیں کیونکہ ماڈل جتنا بڑا ہوتا ہے، نسل کی صلاحیتوں میں اضافہ ہوتا ہے۔\” \”ایک ہی وقت میں، وہ تربیتی کارپس کے اندر موجود مواد کی اصلیت اور تخلیقی صلاحیتوں کو خطرے میں ڈال رہے ہیں۔ یہ ایک اہم تلاش ہے۔\”

    محققین کے مطابق، مطالعہ ٹیکسٹ جنریٹرز اور اخلاقی اور فلسفیانہ سوالات کے بارے میں مزید تحقیق کی ضرورت پر روشنی ڈالتا ہے۔

    مسیسیپی یونیورسٹی میں کمپیوٹر اور انفارمیشن سائنس کے اسسٹنٹ پروفیسر تھائی لی نے کہا، \”اگرچہ آؤٹ پٹ پرکشش ہو سکتا ہے، اور زبان کے ماڈلز استعمال کرنے میں مزہ آ سکتے ہیں اور کچھ کاموں کے لیے نتیجہ خیز لگ سکتے ہیں، لیکن اس کا مطلب یہ نہیں ہے کہ وہ عملی ہیں۔\” جنہوں نے پین اسٹیٹ میں ڈاکٹریٹ کے امیدوار کے طور پر اس پروجیکٹ پر کام کرنا شروع کیا۔ \”عملی طور پر، ہمیں ان اخلاقی اور کاپی رائٹ کے مسائل کا خیال رکھنے کی ضرورت ہے جو ٹیکسٹ جنریٹر لاحق ہوتے ہیں۔\”

    اگرچہ مطالعہ کے نتائج صرف GPT-2 پر لاگو ہوتے ہیں، خودکار سرقہ کا پتہ لگانے کا عمل جو محققین نے قائم کیا ہے اسے نئے زبان کے ماڈلز جیسے ChatGPT پر لاگو کیا جا سکتا ہے تاکہ اس بات کا تعین کیا جا سکے کہ آیا یہ ماڈل تربیتی مواد کی سرقہ کرتے ہیں یا نہیں۔ محققین نے کہا کہ سرقہ کی جانچ، تاہم، ڈویلپرز پر منحصر ہے کہ وہ تربیتی ڈیٹا کو عوامی طور پر قابل رسائی بناتے ہیں۔

    سائنسدانوں کے مطابق، موجودہ مطالعہ AI محققین کو مستقبل میں مزید مضبوط، قابل اعتماد اور ذمہ دار زبان کے ماڈل بنانے میں مدد دے سکتا ہے۔ فی الحال، وہ لوگوں سے ٹیکسٹ جنریٹر استعمال کرتے وقت احتیاط برتنے کی تاکید کرتے ہیں۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے اسسٹنٹ پروفیسر، Jinghui چن نے کہا، \”AI محققین اور سائنس دان اس بات کا مطالعہ کر رہے ہیں کہ زبان کے ماڈلز کو کس طرح بہتر اور زیادہ مضبوط بنایا جائے، اس دوران، بہت سے افراد اپنی روزمرہ کی زندگی میں زبان کے ماڈلز کو مختلف پیداواری کاموں کے لیے استعمال کر رہے ہیں۔\” \”جبکہ لینگویج ماڈلز کو سرچ انجن کے طور پر استعمال کرنا یا ڈیبگ کوڈ کے لیے اسٹیک اوور فلو کرنا شاید ٹھیک ہے، دوسرے مقاصد کے لیے، چونکہ لینگویج ماڈل سرقہ شدہ مواد تیار کر سکتا ہے، اس کے نتیجے میں صارف کے لیے منفی نتائج نکل سکتے ہیں۔\”

    ڈونگ وون لی نے مزید کہا کہ سرقہ کا نتیجہ کچھ غیر متوقع نہیں ہے۔

    انہوں نے کہا کہ \”ایک سٹاکسٹک طوطے کے طور پر، ہم نے زبان کے ماڈلز کو انسانی تحریروں کی نقل کرنا سکھایا بغیر انہیں یہ سکھایا کہ کیسے صحیح طریقے سے سرقہ نہ کیا جائے۔\” \”اب وقت آگیا ہے کہ انہیں مزید صحیح طریقے سے لکھنا سکھایا جائے، اور ہمیں ابھی بہت طویل سفر طے کرنا ہے۔\”

    نیشنل سائنس فاؤنڈیشن نے اس کام کی حمایت کی۔



    Source link

  • Beyond memorization: Text generators may plagiarize beyond \’copy and paste\’: Language models, possibly including ChatGPT, paraphrase and reuse ideas from training data without citing the source, raising plagiarism concerns

    طلباء اپنی اگلی اسائنمنٹ مکمل کرنے کے لیے چیٹ بوٹ استعمال کرنے سے پہلے دو بار سوچ سکتے ہیں۔ زبان کے ماڈل جو صارف کے اشارے کے جواب میں متن تیار کرتے ہیں وہ مواد کو ایک سے زیادہ طریقوں سے سرقہ کرتے ہیں، پین اسٹیٹ کی زیرقیادت ایک تحقیقی ٹیم کے مطابق جس نے اس رجحان کا براہ راست جائزہ لینے کے لیے پہلا مطالعہ کیا۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے پروفیسر ڈونگون لی نے کہا، \”سرقہ سرقہ مختلف ذائقوں میں آتا ہے۔\” \”ہم یہ دیکھنا چاہتے تھے کہ کیا زبان کے ماڈل نہ صرف کاپی اور پیسٹ کرتے ہیں بلکہ اس کو سمجھے بغیر سرقہ کی مزید نفیس شکلوں کا سہارا لیتے ہیں۔\”

    محققین نے سرقہ کی تین شکلوں کی شناخت پر توجہ مرکوز کی: لفظی طور پر، یا براہ راست مواد کو کاپی اور پیسٹ کرنا؛ اصل ماخذ کا حوالہ دیے بغیر پیرا فریز، یا مواد کو دوبارہ ترتیب دینا اور دوبارہ ترتیب دینا؛ اور آئیڈیا، یا کسی متن سے بغیر کسی مناسب انتساب کے مرکزی خیال کا استعمال کرنا۔ انہوں نے خودکار سرقہ کا پتہ لگانے کے لیے ایک پائپ لائن بنائی اور اسے OpenAI کے GPT-2 کے خلاف آزمایا کیونکہ زبان کے ماڈل کا تربیتی ڈیٹا آن لائن دستیاب ہے، جس سے محققین GPT-2 کو پہلے سے تربیت دینے کے لیے استعمال ہونے والی 8 ملین دستاویزات سے تخلیق شدہ متن کا موازنہ کرنے کی اجازت دیتے ہیں۔

    سائنس دانوں نے 210,000 تخلیق شدہ تحریروں کو پہلے سے تربیت یافتہ لینگویج ماڈلز اور فائن ٹیونڈ لینگویج ماڈلز میں سرقہ کی جانچ کرنے کے لیے استعمال کیا، یا مخصوص موضوعات پر توجہ مرکوز کرنے کے لیے مزید تربیت یافتہ ماڈلز۔ اس معاملے میں، ٹیم نے سائنسی دستاویزات، COVID-19 سے متعلق علمی مضامین، اور پیٹنٹ کے دعووں پر توجہ مرکوز کرنے کے لیے تین زبانوں کے ماڈلز کو ٹھیک بنایا۔ انہوں نے ایک اوپن سورس سرچ انجن کا استعمال کرتے ہوئے سرفہرست 10 تربیتی دستاویزات کو بازیافت کیا جو ہر تیار کردہ متن سے ملتا جلتا ہے اور لفظی، پیرا فریز اور آئیڈیا سرقہ کی مثالوں کا بہتر طور پر پتہ لگانے کے لیے موجودہ ٹیکسٹ الائنمنٹ الگورتھم میں ترمیم کی۔

    ٹیم نے پایا کہ زبان کے ماڈلز نے تینوں قسم کے سرقہ کا ارتکاب کیا، اور یہ کہ ماڈل کو تربیت دینے کے لیے ڈیٹاسیٹ اور پیرامیٹرز جتنے بڑے ہوں گے، اتنا ہی اکثر سرقہ ہوتا ہے۔ انہوں نے یہ بھی نوٹ کیا کہ زبان کے عمدہ ماڈلز نے لفظی سرقہ کو کم کیا لیکن پیرا فریز اور آئیڈیا سرقہ کی مثالوں میں اضافہ کیا۔ اس کے علاوہ، انہوں نے زبان کے ماڈل کی ایسی مثالوں کی نشاندہی کی جو سرقہ کی تینوں شکلوں کے ذریعے افراد کی نجی معلومات کو بے نقاب کرتے ہیں۔ محققین اپنے نتائج 2023 ACM ویب کانفرنس میں پیش کریں گے، جو آسٹن، ٹیکساس میں 30 اپریل سے 4 مئی تک ہوتی ہے۔

    پین اسٹیٹ کے کالج آف انفارمیشن سائنسز اینڈ ٹیکنالوجی میں ڈاکٹریٹ کے طالب علم لیڈ مصنف جویونگ لی نے کہا، \”لوگ بڑے زبان کے ماڈلز کی پیروی کرتے ہیں کیونکہ ماڈل جتنا بڑا ہوتا ہے، نسل کی صلاحیتوں میں اضافہ ہوتا ہے۔\” \”ایک ہی وقت میں، وہ تربیتی کارپس کے اندر موجود مواد کی اصلیت اور تخلیقی صلاحیتوں کو خطرے میں ڈال رہے ہیں۔ یہ ایک اہم تلاش ہے۔\”

    محققین کے مطابق، مطالعہ ٹیکسٹ جنریٹرز اور اخلاقی اور فلسفیانہ سوالات کے بارے میں مزید تحقیق کی ضرورت پر روشنی ڈالتا ہے۔

    مسیسیپی یونیورسٹی میں کمپیوٹر اور انفارمیشن سائنس کے اسسٹنٹ پروفیسر تھائی لی نے کہا، \”اگرچہ آؤٹ پٹ پرکشش ہو سکتا ہے، اور زبان کے ماڈلز استعمال کرنے میں مزہ آ سکتے ہیں اور کچھ کاموں کے لیے نتیجہ خیز لگ سکتے ہیں، لیکن اس کا مطلب یہ نہیں ہے کہ وہ عملی ہیں۔\” جنہوں نے پین اسٹیٹ میں ڈاکٹریٹ کے امیدوار کے طور پر اس پروجیکٹ پر کام کرنا شروع کیا۔ \”عملی طور پر، ہمیں ان اخلاقی اور کاپی رائٹ کے مسائل کا خیال رکھنے کی ضرورت ہے جو ٹیکسٹ جنریٹر لاحق ہوتے ہیں۔\”

    اگرچہ مطالعہ کے نتائج صرف GPT-2 پر لاگو ہوتے ہیں، خودکار سرقہ کا پتہ لگانے کا عمل جو محققین نے قائم کیا ہے اسے نئے زبان کے ماڈلز جیسے ChatGPT پر لاگو کیا جا سکتا ہے تاکہ اس بات کا تعین کیا جا سکے کہ آیا یہ ماڈل تربیتی مواد کی سرقہ کرتے ہیں یا نہیں۔ محققین نے کہا کہ سرقہ کی جانچ، تاہم، ڈویلپرز پر منحصر ہے کہ وہ تربیتی ڈیٹا کو عوامی طور پر قابل رسائی بناتے ہیں۔

    سائنسدانوں کے مطابق، موجودہ مطالعہ AI محققین کو مستقبل میں مزید مضبوط، قابل اعتماد اور ذمہ دار زبان کے ماڈل بنانے میں مدد دے سکتا ہے۔ فی الحال، وہ لوگوں سے ٹیکسٹ جنریٹر استعمال کرتے وقت احتیاط برتنے کی تاکید کرتے ہیں۔

    پین اسٹیٹ میں انفارمیشن سائنسز اور ٹیکنالوجی کے اسسٹنٹ پروفیسر، Jinghui چن نے کہا، \”AI محققین اور سائنس دان اس بات کا مطالعہ کر رہے ہیں کہ زبان کے ماڈلز کو کس طرح بہتر اور زیادہ مضبوط بنایا جائے، اس دوران، بہت سے افراد اپنی روزمرہ کی زندگی میں زبان کے ماڈلز کو مختلف پیداواری کاموں کے لیے استعمال کر رہے ہیں۔\” \”جبکہ لینگویج ماڈلز کو سرچ انجن کے طور پر استعمال کرنا یا ڈیبگ کوڈ کے لیے اسٹیک اوور فلو کرنا شاید ٹھیک ہے، دوسرے مقاصد کے لیے، چونکہ لینگویج ماڈل سرقہ شدہ مواد تیار کر سکتا ہے، اس کے نتیجے میں صارف کے لیے منفی نتائج نکل سکتے ہیں۔\”

    ڈونگ وون لی نے مزید کہا کہ سرقہ کا نتیجہ کچھ غیر متوقع نہیں ہے۔

    انہوں نے کہا کہ \”ایک سٹاکسٹک طوطے کے طور پر، ہم نے زبان کے ماڈلز کو انسانی تحریروں کی نقل کرنا سکھایا بغیر انہیں یہ سکھایا کہ کیسے صحیح طریقے سے سرقہ نہ کیا جائے۔\” \”اب وقت آگیا ہے کہ انہیں مزید صحیح طریقے سے لکھنا سکھایا جائے، اور ہمیں ابھی بہت طویل سفر طے کرنا ہے۔\”

    نیشنل سائنس فاؤنڈیشن نے اس کام کی حمایت کی۔



    Source link