# file\_get\_contents() gives slightly altered file contents

**URL:** https://forum.kirupa.com/t/file-get-contents-gives-slightly-altered-file-contents/277414
**Category:** programming
**Created:** [December 11, 2008, 6:22pm UTC](https://forum.kirupa.com/t/file-get-contents-gives-slightly-altered-file-contents/277414 "2008-12-11T18:22:22Z")
**Posts on this page:** 1
**Page:** 1

<div class="post-metadata">

### Author: ![NeoDreamer](https://avatars.discourse-cdn.com/v4/letter/n/ccd318/32.png) [@NeoDreamer](https://forum.kirupa.com/u/NeoDreamer)
#### Post date: [December 11, 2008, 6:22pm UTC](https://forum.kirupa.com/t/file-get-contents-gives-slightly-altered-file-contents/277414/1 "2008-12-11T18:22:22Z")

</div>

I have a simple echo of a website’s source:

```php

echo file_get_contents('http://www.threadless.com/blogs/blogs');	

```

A small portion of the output is a little fishy:

```auto

<a class="pagea selected" href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,1">1</a> <a class="pagea " href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,2">2</a> <a class="pagea " href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,3">3</a> <a class="pagea " href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,4">4</a> <a class="pageelipsa" href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,2826">...</a> <a class="pagea " href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,2827">2,827</a> <a class="pagea " href="/blogs/blogs?token=ccaea4f99cbadd8262c148c86e1d8b06&uuid=5abf8a35510975e77f4618b544f7fe65/page,2828">2,828</a> <div class="pagecontext grey">(84,833 results!)</div> 

```

When viewing the page source of the actual page in a browser, that same area is:

```auto

<a class="pagea selected" href="/blogs/blogs/page,1">1</a> <a class="pagea " href="/blogs/blogs/page,2">2</a> <a class="pagea " href="/blogs/blogs/page,3">3</a> <a class="pagea " href="/blogs/blogs/page,4">4</a> <a class="pageelipsa" href="/blogs/blogs/page,2826">...</a> <a class="pagea " href="/blogs/blogs/page,2827">2,827</a> <a class="pagea " href="/blogs/blogs/page,2828">2,828</a> <div class="pagecontext grey">(84,833 results!)</div> 

```

[![](http://img504.imageshack.us/img504/3469/urlyc4.jpg)](http://imageshack.us)

The file\_get\_contents() actually returns a slightly different contents than the actual page! The function seems to have added “_?token=randomString_” to all of the page traversal URL’s. Since I’m working on a web crawler, this is a big no no. What’s going on?
